Variational Speculative Decoding: Rethinking Draft Training from Token Likelihood to Sequence Acceptance
DGX agentarXiv:2602.05774v4 Announce Type: replace-cross Abstract: Speculative decoding accelerates inference for (M)LLMs, yet a training-decoding discrepancy persists: while existing methods optimize single g