Skip to yearly menu bar Skip to main content


Nexus: Same Pretraining Loss, Better Downstream Generalization via Common Minima

Huanran Chen ⋅ Huaqing ZHANG ⋅ Xiao Li ⋅ Yinpeng Dong ⋅ Ke Shen ⋅ Jun Zhu

Abstract

Chat is not available.