(4 events) Time zone: Conference local time zone
Show all
Toggle Poster Visibility
Oral
Wed Jul 08 10:00 AM -- 10:15 AM (KST) @ HALL B2 None
Mitigating Reward Hacking in RLHF via Bayesian Non-negative Reward Modeling
[
OpenReview]
Oral
Wed Jul 08 10:15 AM -- 10:30 AM (KST) @ HALL B2 None
DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research
[
OpenReview]
Oral
Wed Jul 08 10:30 AM -- 10:45 AM (KST) @ HALL B2 None
Simultaneous Speech-to-Speech Translation Without Aligned Data
[
OpenReview]
Oral
Wed Jul 08 10:45 AM -- 11:00 AM (KST) @ HALL B2 None
Video-Based Optimal Transport for Feedback-Efficient Offline Preference-Based Reinforcement Learning
[
OpenReview]
Successful Page Load