Skip to yearly menu bar Skip to main content


Poster
in
Workshop: SCALE: SCALABLE LEARNING AND OPTIMIZATION FOR EFFICIENT MULTIMODAL AI AGENTS
Fri, Jul 10, 2026 • 12:20 AM – 1:00 AM PDT

SeeTraceAct: Grounding Vision-Language-Action Models with One-Shot Video Demonstrations via Visual Latent Planning

Jaehyeon Son ⋅ Junhyun Kim ⋅ Kyle Kam ⋅ Jinhoo Kim ⋅ Seok J Kim ⋅ Junghwan Yim ⋅ Zsolt Kira

Abstract

Chat is not available.