Gemini·Grok·GPT Image로 구현하는 이중 페르소나 캐릭터 시트 프롬프트 워크플로우
한 인물의 상반된 두 가지 정체성을 분할 레이아웃으로 연출하는 캐릭터 디자인 보드 생성 프롬프트와 Gemini, Grok, GPT Image 2.0을 활용한 실전 워크플로우를 소개합니다.
AI 크리에이터 시랏 파티마(@SeeratFatima112)가 2026년 10월 5일 공유한 캐릭터 시트 워크플로우는 구글 제미나이(Gemini), xAI 그록(Grok), 오픈AI GPT Image 2.0 등 주요 멀티모달 이미지 생성 모델을 활용해 한 인물의 서로 다른 두 가지 페르소나를 한 장의 감각적인 분할 무드보드로 구현하는 실전 프롬프트 가이드입니다.

이미지 출처: @SeeratFatima112 / X
하나의 캐릭터가 지닌 상반된 정체성(예: 필드 위의 공격형 미드필더 축구선수와 일상 속의 스타일리시한 크리에이터)을 한 캔버스에 이중 분할(Split-screen) 형태로 배치하고, 표정 그리드, 프로필 스탯 패널, 원단 텍스처 클로즈업, 컬러 스와치, 손글씨 명언 등을 결합해 상용 콘셉트 아트 수준의 캐릭터 시트를 완성할 수 있습니다.
4단계 캐릭터 시트 제작 파이프라인
원작자가 제시한 기본 워크플로우는 별도의 복잡한 외부 합성이나 파인튜닝 없이, 최신 이미지 생성 인터페이스의 기준 이미지(Reference Image) 업로드 기능을 활용해 4단계로 진행됩니다.
- 모델 인터페이스 접속: Gemini, Grok 또는 GPT Image 2.0 웹/앱 인터페이스에 접속합니다.
- 기준 이미지 업로드 (Upload your image): 얼굴 특징과 인물 정체성의 기준점이 될 사진 또는 기존 캐릭터 초상 이미지를 업로드합니다.
- 통합 프롬프트 입력 (Paste the prompt): 분할 레이아웃 구조, 영역별 의상·헤어·포즈, 표정 그리드, 스탯 패널, 디테일 인셋 컷이 구체적으로 정의된 프롬프트를 입력합니다.
- 이미지 및 비디오 생성 (Generate your image and video): 프롬프트를 실행해 8K 품질의 분할 콘셉트 보드를 생성하고, 필요 시 비디오 생성 모델을 연계해 장면을 애니메이션화합니다.
분할 화면(Split-Screen) 프롬프트의 구조적 분석
이 워크플로우의 핵심은 캔버스를 상하 또는 좌우로 분할하고 각 영역에 상반된 정체성을 부여하면서도 일관된 그리드 캔버스 톤을 유지하도록 지시하는 데 있습니다.
1. 캔버스 뼈대와 공통 스타일 정의
프롬프트 서두에서 전체 레이아웃을 'AARYA PATEL'이라는 타이틀의 프로페셔널 분할 화면 콘셉트 보드로 정의합니다. 따뜻한 오프화이트 그리드 캔버스 위에 세련된 타이포그래피, 컬러 팔레트, 클로즈업 디테일, 손글씨 인용구를 배치하도록 지시해 조잡한 콜라주가 아닌 잡지 에디토리얼 무드보드 느낌을 형성합니다.
2. 상단/좌측 영역: 운동선수 프로필 (The Athlete – Midfielder Profile)
선수로서의 역동성과 규율을 시각화하는 영역입니다.
- 메인 샷: 23세 인도계 여성, 중간 길이의 웨이브 갈색 머리, 블랙 & 골드 팀 유니폼(등번호 10번)과 축구화 착용. 콘크리트 벤치에 축구공과 스포츠 가방을 두고 앉아 있는 전신 샷. 옆면 손글씨 "Discipline Creates Freedom".
- 스탯 패널: 포지션(공격형 미드필더), 성격(규율, 겸손, 지속적 발전), 아키타입(창조자), 신장(178cm / 5'10"), 나이(23세), 국적(인도)을 기재한 텍스트 블록.
- 표정 그리드: 2x2 헤드샷 그리드에 DETERMINED(결연함), HAPPY(행복), FOCUSED(집중), CONFIDENT(자신감)의 4가지 표정 라벨.
- 유니폼 & 컬러 디테일: 골드 클럽 엠블럼, 등번호 10번, 소매 디테일, 원단 질감의 인셋 클로즈업 및 헥스(Hex) 컬러 스와치.
- 액션 샷 & 석양 뷰: 필드 위 드리블·슈팅·세리머니 썸네일과 도시 스카이라인을 배경으로 석양을 바라보는 실루엣 샷("Same Game, New Dreams" 문구).
3. 하단/우측 영역: 크리에이티브 라이프스타일 프로필 (The Creative – Lifestyle & Fashion Profile)
동일 인물의 일상 속 지적이고 감각적인 페르소나를 보여주는 영역입니다.
- 메인 샷: 모노크롬 더스티 블루 착장(오버사이즈 니트 스웨터와 와이드 팬츠 또는 테일러드 블루 수트). 아늑한 스튜디오나 카페에서 커피와 책을 곁에 두고 노트와 펜을 쥔 채 생각에 잠긴 모습.
- 성격 & 바이브: 창의적이고 독립적이며 따뜻하고 집중력 있는 성향. 웜 베이지, 탠, 소프트 블루, 다크 초콜릿 브라운 컬러 스와치.
- 표정 그리드: HAPPY, THOUGHTFUL, PLAYFUL, SERIOUS, CALM 라벨이 달린 부드러운 표정의 가로 헤드샷 열.
- 소재 & 액세서리 디테일: 소프트 블루 니트 원단 질감, 미니멀 레더 백 텍스처, 심플한 골드 펜던트 목걸이 인셋 클로즈업.
- 라이프스타일 컷 & 푸터: 도서관 탐방, 커피 든 모습, 꽃 시장 산책, 트렌치코트 착장 등의 정사각 사진과 필기체 텍스트 "More To Come...", 하단 라벨 "PEOPLE • STORIES • VISUALS".
실전 적용을 위한 영문 통합 프롬프트
아래 프롬프트 전체를 복사하여 Gemini, Grok, 또는 GPT Image 2.0/2.5 입력창에 그대로 붙여넣어 사용할 수 있습니다. 필요에 따라 캐릭터 이름, 연령, 직업, 의상 색상 팔레트 및 스탯 항목을 변경하여 커스텀 캐릭터 시트로 변형할 수 있습니다.
A professional, modern split-screen character concept board titled "AARYA PATEL" featuring two distinct identities of the same young woman—a talented football player and a creative, stylish individual—displayed on a warm off-white grid canvas with elegant typography, color palettes, close-up details, and handwritten quotes.
Top / Left Section (The Athlete – Midfielder Profile):
* Main Shot: A full-body shot of a 23-year-old Indian woman with mid-length wavy brown hair, wearing a black and gold team kit (Jersey #10) with matching shorts, socks, and cleats. She is sitting outdoors on a concrete bench next to a soccer ball and sports bag. Handwritten text on the side reads "Discipline Creates Freedom".
* Stats Panel: Text block stating:
* Role: Attacking Midfielder
* Personality: Disciplined, Humble, Always Improving
* Archetype: The Creator
* Height: 178 cm (5'10")
* Age: 23
* Nationality: Indian
* Facial Expressions Grid: A 2x2 grid of headshots showing four distinct expressions labeled: DETERMINED, HAPPY, FOCUSED, and CONFIDENT.
* Kit & Color Details: Inset close-ups of the gold club crest, jersey number "10", sleeve detail, and fabric texture. Hex color swatches included.
* Action Shots: Small action thumbnails at the bottom showing her dribbling, shooting, and celebrating on the field.
* Bottom Vista: A silhouette/rear shot of her sitting with a football overlooking a city skyline at sunset, with handwritten text reading "Same Game, New Dreams".
Bottom / Right Section (The Creative – Lifestyle & Fashion Profile):
* Main Shot: A full-body and seated shot of the same woman in a stylish monochrome dusty blue outfit (oversized knit sweater with wide-leg pants / tailored blue suit). She holds a notebook and pen, looking thoughtful in a cozy studio or cafe setting with coffee and books nearby.
* Personality & Vibe:
* Traits: Creative, Independent, Kind, Focused, Ambitious, Emotionally Intelligent.
* Color Palette: Warm beige, tan, soft blue, and dark chocolate brown swatches.
* Expressions Grid: A row of headshots depicting soft expressions labeled: HAPPY, THOUGHTFUL, PLAYFUL, SERIOUS, and CALM.
* Texture & Accessory Details: Inset close-ups of soft blue knit fabric texture, minimal leather bag texture, and a simple gold pendant necklace.
* Lifestyle Shots: Small square photos showing her browsing a library, holding coffee, walking through a flower market, and standing in a trench coat.
* Footer: Handwritten cursive text reading "More To Come..." and a footer label "PEOPLE • STORIES • VISUALS".
Overall Visual Style: Hyper-realistic 8K photograph quality, warm and natural editorial lighting, clean graphic design layout, sophisticated font pairings, and a aesthetic mood board presentation.
도구별 활용 팁과 비디오 확장 고려사항
- 인물 일관성(Identity Preservation): 2단계에서 기준 인물 사진을 업로드할 때 얼굴 윤곽과 이목구비가 뚜렷한 고해상도 인물 사진을 활용해야 모델이 분할된 양쪽 영역 모두에서 동일 인물의 얼굴을 정밀하게 유지합니다.
- 도구별 기능 지원 범위:
- Google Gemini: 텍스트 프롬프트 기반 이미지 생성(
gemini-3.1-flash-image)과 텍스트·이미지 혼합 응답을 지원하며, Gemini 앱 내에서 Gemini Omni를 통한 레퍼런스 기반 비디오 생성과 SynthID 워터마킹을 제공합니다. - xAI Grok (Imagine Image 2.0): 최대 3장의 참조 이미지를 첨부한 이미지 편집 기능을 지원하며, 동일 스타일의 캐릭터·배경·소품을 연속 생성할 수 있는 작업 템플릿과 API(
grok-imagine-image-2.0)를 갖추고 있습니다. - OpenAI GPT Image (2.0 / 2.5): 정밀 편집용
gpt-image-2.5-sunburst와 고속 생성용gpt-image-2.5-flare모델을 제공하며, 참조 이미지를 활용한 이미지 편집 및 멀티턴 대화형 편집 기능을 지원합니다.
- Google Gemini: 텍스트 프롬프트 기반 이미지 생성(
- 영상화 파이프라인 연계: 워크플로우 4단계에 명시된 비디오 생성은 완성된 콘셉트 보드의 서브 패널이나 썸네일 컷을 참조 이미지로 활용해 이미지 투 비디오(Image-to-Video) 모델(예: 최대 5장의 참조 사진을 지원하는 Gemini Omni 등)과 연계할 수 있으며, 지원 모델에 따라 디지털 워터마크(SynthID 등)가 적용됩니다.
원문 출처
- Seerat Fatima (@SeeratFatima112) X 게시글: https://x.com/SeeratFatima112/status/2106928532048040014