Skip to yearly menu bar Skip to main content


Poster
in
Workshop: RLxF: RL from World Feedback
Fri, Jul 10, 2026 • 4:00 PM – 5:00 PM KST

Bayesian Preference Learning for Test-Time Steerable Reward Models

Jiwoo Hong ⋅ Shao Tang ⋅ Zhipeng Wang

Abstract

Chat is not available.