Skip to yearly menu bar Skip to main content


Reinforcement Learning in Language Models Recruits a Shared Functional Welfare Axis

Andy Q Han ⋅ David J Chalmers ⋅ Pavel Izmailov

Abstract

Chat is not available.