Skip to yearly menu bar Skip to main content


Poster Thu, Jul 9, 2026 • 5:00 PM – 6:45 PM KST HALL A #4408

Beyond Benchmarks: Toward Causally Faithful Evaluation of Large Language Models

Zhengshuyuan Tian ⋅ Wanling Gao ⋅ Chuanxin Lan ⋅ Chenxi Wang ⋅ Lei Wang ⋅ Guoxin Kang ⋅ Zhengxin Yang ⋅ Yunyou Huang ⋅ Xuehai Hong ⋅ Jianfeng Zhan

Abstract

Lay Summary

Video

Chat is not available.