Speculative Decoding Prompting

How to structure prompts and utilize Predicted Outputs (OpenAI/vLLM) to maximize speculative draft token acceptance rates, speeding up code generation by 3x at zero cost.

alivirgo 3313bcb 4.4 KB Updated

File contents

alivirgo/Major-AI-Skills/tree/main/skills/speculative-decoding-prompting commit 3313bcb535

Frequently asked questions

npx skillmds@latest add alivirgo/speculative-decoding-prompting