Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-Training
Paper Two Designs That Make Speculative Decoding Practical for Large-Scale, Long-Context RL Post-TrainingTL;DR : Rollout generation …
11 min
Speculative Decoding
Long Context
Reinforcement Learning
Distributed Computing
Efficient Training
Inference Acceleration