Skip to yearly menu bar Skip to main content


Poster
in
Workshop: SCALE: SCALABLE LEARNING AND OPTIMIZATION FOR EFFICIENT MULTIMODAL AI AGENTS
Fri, Jul 10, 2026 • 12:20 AM – 1:00 AM PDT

Predictive Routing Replay for MoE-based LLM Reinforcement Learning

Daize Dong ⋅ Junlin Chen ⋅ Haolong Jia ⋅ Jiawei WU ⋅ Jiang Liu ⋅ Jialian Wu ⋅ Zhengzhong Liu ⋅ Zicheng Liu ⋅ Emad Barsoum ⋅ Dimitris Metaxas ⋅ Hongyi Wang

Abstract

Chat is not available.