Skip to yearly menu bar Skip to main content


Poster Thu, Jul 9, 2026 • 2:30 PM – 4:15 PM KST HALL A #4603

Beyond Majority Voting: Self-Reflective Test-Time Reinforcement Learning for LLM Reasoning

Sitong Wu ⋅ Haoru Tan ⋅ Xichen Zhang ⋅ Bin Xia ⋅ Shaofeng Zhang ⋅ XIAOJUAN QI ⋅ Bei Yu ⋅ Jiaya Jia

Abstract

Lay Summary

Video

Chat is not available.