Qwen3.5-0.8B 기반 일본어 초경량 모델 v2 공개: 표현 자연스러움 개선, 가중치 즉시 다운로드
개발자 atemoya가 Qwen3.5-0.8B 기반 일본어 SFT 모델의 v2 버전을 허깅페이스에 공개했습니다. 지식량 확장보다 일본어 출력의 자연스러움 개선에 초점을 맞췄으며, 가중치는 즉시 내려받을 수 있고 브라우저 추론 환경은 준비 중입니다.
개발자 atemoya(허깅페이스 계정 Takenoko12345678)가 2026년 10월 3일, Qwen3.5-0.8B 기반 일본어 특화 SFT 모델의 v2 버전인 Qwen3.5-0.8B-Japanese-SFT-v2를 허깅페이스에 공개했습니다. 정식 안내 게시물은 뒤따를 예정이지만, 작성자 본인의 게시물에 따르면 가중치 다운로드는 이미 가능합니다.

이미지 출처: https://huggingface.co/Takenoko12345678/Qwen3.5-0.8B-Japanese-SFT-v2
이번 v2는 0.8B 파라미터 초경량 구조를 유지하면서, 지식 자체의 양적 확장보다는 일본어 출력의 자연스러움과 유창성 개선에 초점을 맞췄다는 것이 작성자의 설명입니다. 브라우저에서 바로 실행하는 웹 추론 환경은 현재 준비 중이므로, 당장은 허깅페이스에서 가중치를 내려받아 로컬에서 사용해야 합니다.
v2에서 바뀐 점과 현재 이용 방법
v2에 대한 작성자의 직접 설명은 두 가지로 요약됩니다.
- 일본어 자연스러움 개선: 지식은 "그렇게 극단적으로 늘지 않았지만", 일본어의 자연스러움은 꽤 올라갔을 것이라는 게 작성자의 표현입니다.
- 이용 경로: 허깅페이스 저장소를 통한 가중치 다운로드는 즉시 가능하며, 웹 추론(Web推論) 환경은 준비 중입니다.
초경량 모델이라는 점에서 온디바이스·로컬 실행이 전제이며, 외장 GPU가 없는 PC 환경을 염두에 둔 흐름이라는 점은 이전 v1 공개 때의 설명과 이어집니다.
v1에서 확인된 기준점 (v2 수치와 혼동 금지)
다음 수치와 설명은 v2가 아니라 하루 전인 10월 2일 공개된 v1 버전에 대한 작성자의 게시물에서 나온 것입니다. v2의 독립 벤치마크 수치로 읽어서는 안 됩니다.
- 기반 모델: Qwen3.5-0.8B에서 출발한 일본어 모델입니다.
- 작성자가 밝힌 v1 기준점: 일본어 상식 문제 정답률이 41.7%에서 69.4%로 올랐고, GPU가 없는 PC에서도 1회 응답이 1초 전후로 반환된다는 설명입니다.
- 학습 데이터: v1 공개 시점에 학습 데이터도 전부 공개済み라고 밝혔습니다.
- v1 브라우저 추론: v1용 브라우저 추론 링크가 별도로 안내된 바 있으나, 프라이빗 모드에서는 사용할 수 없다는 주의가 함께 적혀 있었습니다.
정리하면, v2는 v1의 경량·로컬 실행 노선을 계승하면서 표현 품질을 다듬은 업데이트이며, 성능을 숫자로 비교하려면 v2 전용 측정 결과가 나올 때까지 기다려야 합니다.
출처
- atemoya (@atemoyacoding) X 게시물 (v2 공개 안내): v2 다운로드 가능 안내
- atemoya (@atemoyacoding) X 게시물 (웹 추론 준비 중·자연스러움 개선 언급): v2 후속 설명
- atemoya (@atemoyacoding) X 게시물 (v1 기준점·학습 데이터 공개 안내): v1 공개 안내
- Hugging Face: Takenoko12345678/Qwen3.5-0.8B-Japanese-SFT-v2