대비 언어 모델(CLM), 최대 9배 빠른 의사결정 달성
스탠퍼드대와 NVIDIA 연구진이 대비 학습(contrastive learning) 목표로 상태와 행동을 연결하는 새로운 모델 클래스 '대비 언어 모델(CLM)'을 발표했습니다. CLM-8B는 컴퓨터 조작, 게임, 도구 호출 작업에서 Jev와 대등한 성능을 내면서도 최대 9배 낮은 지연시간을 보이며, 미세조정만으로 DeepSWE(81.6%), Terminal Bench 2.1(87.6%) 등 에이전트 코딩 벤치마크에서 새로운 SOTA를 달성했습니다. 또한 상태와 행동의 임베딩을 독립적으로 캐싱·재사용하는 초효율 훈련·서빙 인프라와 함께 CLM의 스케일링 법칙도 제시했습니다.