ChatGPT와 Seedance 2.5로 구현하는 무촬영 바이럴 숏폼 인물 교체 워크플로우
검증된 바이럴 숏폼 영상의 인물을 ChatGPT 캐릭터 설정표와 Seedance 2.5 전능 참조 기능으로 자연스럽게 교체하여 직접 촬영 없이 숏폼을 제작하는 3단계 AI 실전 팁.
직접 카메라 앞에 서거나 영상을 새로 촬영하지 않고도 검증된 바이럴 숏폼의 연출과 모션을 그대로 살려 새로운 콘텐츠를 제작하는 워크플로우가 주목받고 있습니다. AI 크리에이터 @DDJCXX가 공유한 이 기법은 ChatGPT를 활용해 독창적이면서도 실사감 있는 캐릭터를 설계하고, Seedance 2.5의 전능 참조(Omni Reference) 기능을 통해 원본 영상 속 인물만 정교하게 교체하는 3단계 제작 파이프라인입니다.

이미지 출처: X @DDJCXX
1단계: ChatGPT로 일관성 있는 캐릭터 설정표(턴어라운드) 생성하기
캐릭터를 설계할 때 의상이나 장식을 무리하게 겹쳐 과장하기보다는, 1~2개의 개성 있는 특징만 뚜렷하게 강조하고 나머지 요소는 평범한 실사 인물 스타일을 유지하는 것이 완성도를 높이는 핵심입니다.
- 프롬프트 구성: ChatGPT(DALL-E)에 회색 단색 배경과 실사 사진(realistic photo) 스타일을 지정합니다.
- 다각도 시트 제작: 상단에는 5개 전신 앵글, 하단에는 3개 근접(클로즈업) 컷으로 구성된 일체형 캐릭터 턴어라운드 설정표를 1장 생성합니다.
- 정면 반신 사진 추가 확보: 교체 과정에서 얼굴 특징과 표정 일관성을 단단하게 고정하기 위해 정면을 바라보는 반신 프로필 사진을 추가로 1장 준비합니다.
2단계: 교체 적합도가 높은 30초 이내 바이럴 원본 영상 선별하기
모든 영상이 AI 인물 교체에 적합한 것은 아닙니다. 이미 대중의 검증을 거친 바이럴 영상 중 다음 4가지 조건을 충족하는 클립을 선별해야 교체 후 왜곡을 방지할 수 있습니다.
- 단독 출연: 화면 내에 다른 인물이 겹치지 않고 오직 1명만 단독으로 등장하는 영상이어야 합니다.
- 안정적인 카메라 워크: 핸드헬드 흔들림이나 급격한 카메라 무빙이 적고 시점과 앵글이 안정적인 클립을 선택합니다.
- 헤드룸 확보: 인물의 머리 윗공간(헤드룸)이 충분히 확보되어 있어 새로운 헤어스타일이나 체형이 프레임 밖으로 잘리지 않아야 합니다.
- 길이 제한: 인물 추적의 정확도와 토큰 소모를 고려해 30초 이내의 숏폼 영상을 사용합니다.
3단계: Seedance 2.5 전능 참조(Omni Reference)로 인물 교체 실행하기
준비된 에셋을 Seedance 2.5의 전능 참조 인터페이스에 업로드하고 정밀 프롬프트를 작성하여 인물을 교체합니다.
- 에셋 업로드 순서: 원본 영상(
@video1), 8컷 캐릭터 설정표(@image1), 정면 반신 사진(@image2)을 순서대로 지정합니다. - 실전 프롬프트 템플릿:
영상 편집: @video1의 [대상 인물]을 @image1과 @image2의 캐릭터로 교체. [캐릭터의 구체적인 헤어스타일, 이목구비 특징, 의상 명시] @video1의 동작, 표정, 립싱크, 씬 배경, 조명, 카메라 앵글을 엄격히 유지하고 어떤 인물이나 물체도 추가하거나 삭제하지 말 것. 오디오: @video1의 원본 사운드 유지.
실전 제작 비용과 모델 선택 가이드
- 제작 비용: Seedance 2.5 기준 영상 1편 생성에 약 10
20위안(한화 약 2,0004,000원) 수준의 비용이 소요됩니다. - 모델 안정성: 저가형 비디오 생성 모델의 경우 인물 교체 시 얼굴 일관성이 무너지거나 원본의 미세한 표정 및 립싱크를 놓치는 문제가 발생하기 쉬우며, 실측 결과 동작 유지력과 디테일 보존 측면에서 Seedance 2.5가 가장 안정적인 결과물을 제공합니다.