스탠퍼드 Hazy Research, Jev 대비 최대 9배 빠른 대조 언어 모델 'CLM-8B' 오픈 가중치 공개
스탠퍼드 Hazy Research가 상태-행동 임베딩 분리 캐싱과 대조 학습을 적용한 시스템 1 결정 모델 CLM-8B의 가중치와 코드를 오픈소스로 공개했습니다. 제브(Jev) 대비 최대 9~13배 빠른 추론과 DeepSWE 등 에이전트 벤치마크 SOTA를 보고했습니다.
TAU HOME에서 SystemOne 태그로 묶인 글입니다.
스탠퍼드 Hazy Research가 상태-행동 임베딩 분리 캐싱과 대조 학습을 적용한 시스템 1 결정 모델 CLM-8B의 가중치와 코드를 오픈소스로 공개했습니다. 제브(Jev) 대비 최대 9~13배 빠른 추론과 DeepSWE 등 에이전트 벤치마크 SOTA를 보고했습니다.