Preprint
Jul 2026
PyroDash: Cost-Efficient Token-Level Small-Large Language Model Collaborative Inference
Results show that learned token-level handoffs can reduce LLM use while preserving strong reasoning performance, and show that learned token-level handoffs can reduce LLM use while preserving strong reasoning performance.
Niqi Lyu, Pengtao Shi, Wei Qiu et al.
· 0 citations