Skip to yearly menu bar Skip to main content


(4 events)   Timezone:  
Show all
Toggle Poster Visibility
Oral
Tue Jul 07 06:00 PM -- 06:15 PM (PDT) @ HALL D2 None
Position: AI Should Facilitate Democratic Deliberation at Scale
José Ramón Enríquez ⋅ Jiaxin Pei ⋅ Alex Pentland
[ OpenReview
Oral
Tue Jul 07 06:15 PM -- 06:30 PM (PDT) @ HALL D2 None
Activation Oracles: Training and Evaluating LLMs as General-Purpose Activation Explainers
Adam Karvonen ⋅ James Chua ⋅ Clément Dumas ⋅ Kit Fraser-Taliente ⋅ Subhash Kantamneni ⋅ Julian Minder ⋅ Euan Ong ⋅ Arnab Sen Sharma ⋅ Daniel Wen ⋅ Owain Evans ⋅ Samuel Marks
[ OpenReview
Oral
Tue Jul 07 06:30 PM -- 06:45 PM (PDT) @ HALL D2 None
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
Addison J. Wu ⋅ Ryan Liu ⋅ Xuechunzi Bai ⋅ Thomas Griffiths
[ OpenReview
Oral
Tue Jul 07 06:45 PM -- 07:00 PM (PDT) @ HALL D2 None
Mechanistic Data Attribution: Tracing the Training Origins of Interpretable LLM Units
Jianhui Chen ⋅ Yuzhang Luo ⋅ Liangming Pan
[ OpenReview