Skip to yearly menu bar Skip to main content


Poster
in
Workshop: 3rd AI for Math Workshop: Toward Self-Evolving Scientific Agents
Sat, Jul 11, 2026 • 12:00 AM – 1:00 AM PDT

VeriBench: An End-to-End Formal Verification Benchmark for AI Coding Agents in Lean 4

Brando Miranda ⋅ Srivatsava Daruru ⋅ Ethan S Hersch ⋅ (Andrew) Zhanke Zhou ⋅ Allen Nie ⋅ Daneshvar Amrollahi ⋅ Leni Aniva ⋅ Iddah Mlauzi ⋅ Kirill Acharya ⋅ Elyas Obbad ⋅ Dilara Soylu ⋅ Weston Kirk ⋅ Zixiao Jolene Wang ⋅ Kai Fronsdal ⋅ Ying Li ⋅ Donald Poindexter ⋅ Rakshit Kaushik ⋅ Shurui Liu ⋅ Yegor Denisov-Blanch ⋅ Steven Dillmann ⋅ Simon Obstbaum ⋅ Santiago Cuellar ⋅ John Sarracino ⋅ Rylan Schaeffer ⋅ Mo Tiwari ⋅ Donghyun Lee ⋅ Bo Han ⋅ Sanmi Koyejo

Abstract

Chat is not available.