Tavus, 실시간 화상 대화 모델 'Griffin' 공개: 1분 영상 통화에서 48%가 사람으로 오인
Tavus가 2026년 10월 1일 실시간 전이중 비디오-투-비디오 대화 모델인 인간 상호작용 모델(HIM) Griffin을 발표했습니다. 자체 54회 블라인드 테스트에서 48%가 상대방을 실제 사람으로 인식했고, NVIDIA VideoFDB 벤치마크에서 인간 기준점에 근접한 3.83점
미국 AI 연구 기업 Tavus가 2026년 10월 1일 실시간 양방향 화상 대화가 가능한 인간 상호작용 모델(Human Interaction Model, HIM) 'Griffin'을 공식 발표했습니다. 말하는 동안 듣고, 듣는 동안 반응하는 전이중(full-duplex) 비디오-투-비디오 아키텍처를 적용한 것이 핵심이며, Tavus는 이를 새로운 모델 분류인 HIM의 첫 사례로 제시했습니다.

이미지 출처: Tavus
이번 발표의 근거는 두 가지 수치입니다. Tavus 자체 블라인드 테스트에서는 1분 화상 통화 참가자 54명 중 26명(48%)이 상대방을 실제 사람으로 인식했고, NVIDIA의 전이중 AI 비디오 벤치마크(VideoFDB)에서는 인간 기준점 3.92에 근접한 3.83점으로 1위를 기록했습니다. 다만 48% 수치는 Tavus 자체 연구 결과이며, 표준화된 독립 기관의 공인 테스트는 아닙니다. 실제 사람으로 오인될 수 있다는 점을 이유로 일반 공개는 보류 중이며, 현재는 리서치 프리뷰인 Griffin-Lite 형태로 제한적 접근만 제공됩니다.
48% 화상 튜링 테스트와 NVIDIA VideoFDB 1위의 의미
Tavus는 Griffin이 실시간 화상 튜링 테스트를 통과한 첫 모델이라고 주장합니다. 테스트 방식은 Griffin-Lite 기반 시스템과의 1분 라이브 화상 통화를 블라인드로 진행한 것으로, 참가자 54명 중 26명(48%)이 상대방이 실제 사람이라고 답했습니다. 같은 절차로 진행한 Tavus의 이전 세대 시스템 대조군에서는 41명 중 1명(2.4%)만이 사람으로 오인되어, 기존 시스템의 3% 미만 통과율과 뚜렷한 격차를 보였다고 Tavus는 밝혔습니다.
NVIDIA의 전이중 AI 비디오 벤치마크인 VideoFDB에서는 3.83점을 기록해 공개 리더보드 1위에 올랐습니다. 인간 기준점이 3.92점이므로 AI 기록으로는 최고 수준이자 인간 수준에 근접한 수치라고 Tavus는 설명합니다. 두 수치 모두 발표 주체가 Tavus이며, 화상 튜링 테스트 부분은 표준 프로토콜이 아닌 자체 설계 실험이라는 점을 감안하고 읽어야 합니다.
얼굴 립싱크를 넘어 전체 프레임을 생성하는 전이중 구조
Griffin은 얼굴 부분만 합성하는 립싱크 방식이 아니라 전체 영상 프레임을 생성합니다. 상대방의 음성과 영상을 1초 이하 간격으로 지속적으로 감지하면서 말·표정·손동작·침묵 타이밍에 반응하고, 보고 있는 장면이 말하고 있는 내용 자체를 바꿀 수 있다는 것이 Tavus의 설명입니다. 전이중이란 한쪽이 끝나기를 기다리는 무전기 방식이 아니라, 사람처럼 듣고 말하고 끼어들고 겹치는 동작이 동시에 일어난다는 의미입니다.
Tavus가 X 스레드로 공개한 데모는 이 구조를 구체적으로 보여줍니다. 'Simon Says' 게임에서는 "Simon says" 지시를 들으면서 참가자의 손동작을 보고 자신의 손을 움직여야 하고, 루빅스 큐브 코칭 장면에서는 상대방 손에 든 큐브를 보며 지도하다가 상대방이 생각에 잠겨 조용해지면 말을 멈추고 기다립니다. 납땜 작업 코칭에서는 시선을 피하지 않고 작업 과정을 안내하며 시간을 세어주고, 이야기 도중 공작새 인형을 들어 보이자 이를 줄거리에 바로 녹여내는 장면도 공개됐습니다. 감정 표현 역시 음성·표정·몸짓이 동시에 드러나도록 설계됐다고 Tavus는 밝혔습니다.
일반 공개 보류와 Griffin-Lite 제한 제공
실제 사람으로 착각할 수 있는 수준에 도달했다는 점이 곧 출시 제약 사유가 됐습니다. Tavus는 Griffin이 실제 사람으로 오인될 수 있는 첫 모델인 만큼, 공개 전에 안전 대책이 필요하다며 전면 출시를 보류했습니다. 현재는 선별된 소수 테스터에게만 Griffin-Lite라는 리서치 프리뷰 접근이 열려 있으며, 작동 원리와 테스트 방법, 선행되어야 할 안전 조치를 정리한 리서치 프리뷰 문서는 Griffin 공식 페이지에서 확인할 수 있습니다. AI 식별 표시와 오용 방지 장치가 마련되기 전까지는 고객 대상 정식 제공도 대기 상태입니다.
출처
- Tavus 공식 페이지: Griffin: The First Human Interaction Model
- Tavus 공식 X (@tavus): Introducing Griffin, the first model to pass the video Turing test