Skip to yearly menu bar Skip to main content


Reinforcement Learning with Promising Tokens for Large Language Models

Jing-Cheng Pang ⋅ Liang Lu ⋅ Xian Tang ⋅ KUN JIANG ⋅ Sijie Wu ⋅ Kai Zhang ⋅ Xubin Li

Abstract

Video

Chat is not available.