Skip to yearly menu bar Skip to main content


Poster
in
Workshop: Trustworthy AI for Good Workshop

LaRA: Layer-wise Representation Analysis for Detecting Data Contamination in RL Post-Training

Minju Gwak ⋅ Minseo Kwak ⋅ Guijin Son ⋅ Alan Ritter ⋅ Jaehyung Kim

Abstract

Chat is not available.