상태·행동 대조 학습 기반 초고속 System 1 모델 'CLM-8B' 공개: DeepSWE 81.6% 달성
Azalia Mirhoseini와 Jacky Kwok 연구팀이 상태와 액션을 대조 학습으로 연결하는 시스템 1 모델 CLM-8B를 공개했습니다. 경량 파인튜닝을 통해 DeepSWE 81.6% 및 Terminal-Bench 2.1 87.6%로 에이전틱 코딩 SOTA를 경신하고 기존 Jev
TAU HOME에서 System1 태그로 묶인 글입니다.
Azalia Mirhoseini와 Jacky Kwok 연구팀이 상태와 액션을 대조 학습으로 연결하는 시스템 1 모델 CLM-8B를 공개했습니다. 경량 파인튜닝을 통해 DeepSWE 81.6% 및 Terminal-Bench 2.1 87.6%로 에이전틱 코딩 SOTA를 경신하고 기존 Jev
Flock.io가 2B 규모의 오픈소스 의사결정 모델 THIS / THAT Model 1.0을 공개했습니다. 텍스트 토큰 생성 대신 히든 스테이트에서 직접 판단을 판독하여 노트북 GPU에서 30.9ms 속도로 분류, 라우팅, 유효성 검증을 처리하는 구조와 활용법을 정리합니다.