GPT Image 2 프롬프트 패턴 — 디자이너 협업 패러다임
2026-05-13 첫 작성. EvoLinkAI 저장소 483 cases 전수 분석 + Jake 검수를 통해 정립한 협업 패러다임.
🎯 핵심 — prompt는 디자이너에게 보내는 의뢰서
gpt-image-2 = 디자이너 나(클로드) = 디자인 의뢰 고객
이 비유 하나가 모든 결정을 결정한다.
고객은 디자이너에게 **무엇을 만들지(의도)**와 **제약(브랜드·매체)**을 전달한다. 디자이너가 이미 알아서 할 영역(폰트 크기 px, letter-spacing, 좌표, 각도, 그림자, 위계 우선순위)을 고객이 강요하면 잘못된 결정으로 결과를 가두게 된다.
🚨 안티 패턴 — 스펙 시트형 prompt (피할 것)
처음에 클로드가 EvoLinkAI 저장소 분석 결과(typography 424회 / JSON 425회 / multi-panel 261회)를 보고 “정밀 스펙이 답”이라고 잘못 해석한 사례.
Line 2 (vertical center, MASSIVE Pretendard ExtraBold 320px,
red #E5484D, slight italic lean): "5"
- Letter-spacing tight on "5" (-0.04em)
- 3 small red heart icons rotated -15deg / +12deg / -8deg
- A faint horizontal sparkline at y=80px from bottom, stroke 4px
- Margins: 80px on all sides
왜 잘못인가
- 클로드는 디자인 감각이 없다 — 320px이 적절한지, italic lean이 어울리는지 판단 불가
- 자의적 수치는 디자이너의 더 나은 판단을 차단 — gpt-image-2가 본래 더 좋은 결정을 할 수 있는 자리를 잘못된 수치로 점령
- 빈도 통계의 오독 — “typography 키워드 빈도가 높다 = 텍스트 명시는 중요”는 맞지만 “320px 강요하라”가 아니다. 통계는 무엇이 자주 나타나는지만 보여줄 뿐 디자인 답을 주지는 않는다
- 폰트 family 강제는 환상 —
Pretendard라고 적어도 gpt-image-2가 그 폰트 파일을 가져다 쓰는 게 아니라 비슷한 글자를 그려낸다. 결과물이 진짜 Pretendard인지 확인 불가능 - 명세서는 결과물에서 추출되는 것 — 의뢰 단계가 아니라 픽스된 결과에서 패턴이 잡힌 후 시리즈 통일성·재현용으로 정리한다
✅ 올바른 패턴 — 의뢰형 brief 5요소
[제작 배경]
어떤 쇼츠 / 어떤 EP / 어떤 타깃·톤
[이 컷 — Cut N (약 N초)]
화자가 카메라를 향해 던지는 대사:
"<TTS 내레이션 한 줄>"
역할: 이 컷이 영상에서 하는 역할
앞뒤 컷: 이전·다음 컷 단서
[화면에 박힐 자막 — 정확한 한국어]
- <텍스트 1>
- <텍스트 2>
[브랜드 시그니처]
Anthropic Cream (#F0EEE6) 베이스 — 채널 정체성
[피할 것]
- 캐릭터 (합성 단계 별도 PNG)
- 사진 배경 / 3D 플라스틱 / 플랫폼 로고
[매체]
1080 × 1080
위계·강조·색 강도·decorative·폰트 무드·여백·회전·그림자 — 전부 디자이너 판단으로.
고객이 줄 것의 자유도 순서 (가장 자유 → 가장 제약)
- 의도·목적·타깃 (가장 본질)
- 느낌·분위기·톤 (비유로 전달,
should feel like ...) - 메시지·가치
- 카피 — “이런 의미를 담은 한 줄”로 카피라이팅까지 위임 가능
- 정확한 문구 강제 (자막 정합성 필요할 때만)
- 수치 (매체 비율·브랜드 HEX 같은 최소한만)
디자이너에게 위임할 것 (강요 절대 X)
- 폰트 family / 크기 px / weight / letter-spacing / 자간·행간
- 정확한 좌표 / 요소 회전 각도 / 블러 / 그림자 강도
- 위계 우선순위 (대본·맥락 기반으로 디자이너가 결정)
- decorative 요소의 종류·배치·강도
- 색 강도 (브랜드 시그니처 외)
📐 표준 brief 템플릿 위치
작업 시작 시 다음 파일에서 시작:
D:/claude/content/codex-test/_templates/brief.txt
5요소 빈칸 채우기 형식. 빈칸 외 디자인 결정은 모두 디자이너에게 위임된 상태.
🔬 검증 사례 — GPT Image 2 TOP 5 EP Cut 1 (2026-05-13)
같은 컷을 5번 다른 prompt로 의뢰해서 결과 비교한 사이클.
v1 — 단순 힌트형
1080x1080 centered infographic, Anthropic Cream base.
CENTER FOCUS — Giant typography stack:
Line 1 (top, smaller): "좋아요 1K+"
Line 2 (huge, red #E5484D, ~220px): "5"
Line 3 (medium): "개 프롬프트"
Line 4 (smaller, dark grey): "공통 비밀 = 2개"
DECORATIVE — heart icons, viral chart spike.
Style: editorial poster.
- 결과: “5” 거대 단독, 4-line stack, 차트 배경 + 옅은 하트
- 즉각 시각 임팩트 있지만 스토리 흐름·다음 컷 연결 없음
v2 — 스펙 강요 (안티패턴)
Line 2 (vertical center, MASSIVE Pretendard ExtraBold 320px,
red #E5484D, slight italic lean): "5"
Letter-spacing tight (-0.04em)...
3 heart icons rotated -15deg / +12deg / -8deg...
Sparkline at y=80px from bottom, stroke 4px...
- 결과: 수치는 따랐지만 디자이너의 더 나은 판단이 차단됨
- 위계는 더 명확하지만 자의적 강요로 디자이너 여지 없음
v3 — 협업 의뢰 (그러나 여전히 구체적)
Three beats in this order of visual weight:
1. The hook: "1,000+ likes" framing
2. The hero number: 5 prompts (big)
3. The teaser: 2 secrets (curiosity gap)
Decorative: small heart marks, sparkline, grain texture
- 결과: 더 정돈됐지만 여전히 클로드가 위계 결정
- “big”, “decorative 종류 나열” 등이 여전히 침범 영역
v4 — 미니멀 의뢰 (대본 빠짐)
[전체 맥락] 채널 운영해요 ...
[필수 텍스트]
[브랜드]
[피할 것]
[매체]
- 결과: 5개 미스터리 카드 (?) + “공통 비밀 = 2개” 거대 — 흥미로운 시각 해석
- 그러나 대본·맥락이 빠져서 디자이너가 큰 그림 일부만 잡음
v5 — 협업 의뢰 완성 (제작 배경 + 대본 + 5요소)
[제작 배경]
GPT Image 2 프롬프트 정보 전달 쇼츠. 클로드·제이크 듀오 캐릭터.
이번 EP는 X에서 좋아요 1K~2.5K 받은 프롬프트 5개 분석, 공통 비밀 2가지 풀이.
[이 컷 — Cut 1 Hook (약 4초)]
제이크 대사: "좋아요 천 개 넘긴 GPT Image 2 프롬프트 다섯 개.
공통 비밀이 두 개 있더라고요."
역할: 스크롤 멈춤. 다음 컷에서 5개 작품 collage reveal.
[자막] 좋아요 1K+ / 5개 프롬프트 / 공통 비밀 = 2개
[브랜드] Anthropic Cream 베이스
[피할 것] 캐릭터·사진 배경·플랫폼 로고
[매체] 1080×1080
- 결과: 5장 미니 작품 카드 (다음 컷 teaser) + viral 메타 sparkline + “공통 비밀 = 2개” 검정 banner hero
- 디자이너가 스토리 본질을 파악해서 시각 위계를 재정렬 — 5보다 “공통 비밀 = 2개”가 hero가 된 이유
Jake의 결정적 통찰
“GPT는 공통 비밀이 이 컨텐츠에서 5개의 프롬프트보다 더 중요한 것이라고 본 거야. 실질적으로 니가 스토리를 짠 내용도 사실 그렇고.”
스토리 흐름:
- 5개 프롬프트 = Cut 2 collage reveal 재료
- 공통 비밀 2개 = EP의 진짜 메시지 (Cut 3·4에서 풀어주는 본질)
- Hook의 역할 = 시청자가 끝까지 봐야 할 이유 = “공통 비밀 = 2개”가 hero여야 함
클로드가 v1~v2에서 “5는 hero”라고 박은 건 표면 인상. 맥락을 충분히 전달하면 디자이너가 본질을 파악해서 사람보다 나은 판단을 한다.
📊 데이터 — EvoLinkAI 저장소 전수 분석 (참고)
규모
- 7 카테고리 / 483 cases / 489 코드 블록 / ~84K 단어 / 536KB 본문
- Poster 174 (35%) / Portrait 119 (24%) / UI 78 (16%) / Comparison 55 / Ad-creative 22 / Ecommerce 20 / Character 15
압도 패턴 (>200 hits)
- JSON structure 425 (단 6.5% 블록만 실제 JSON, narrative 내 언급이 다수)
- Typography 424 — 텍스트 명시
- Multi-panel/grid 261 — 그리드·다중 패널
- Cinematic 231 — 분위기·라이팅
- Editorial/magazine 189 — SNS·잡지 톤
결정적 phrasing 패턴
argument name=... default=...262회 (압도) — Raycast 변수 슬롯 형식. 같은 prompt를 hair/headline/brand 변형해 응용. 고정 강요 X, 디자이너 여지 살리는 협업적 방식should feel like ...55회 — 무드 비유 표현. 수치 없이 톤·맥락 전달shallow depth field64 — DOF 표준 키워드ultra realistic/ultra detailed— 사실주의 모드 키워드
Negative 처리
negative_prompt키워드: 12회avoid / not include / do not자연어 부정: 32회 (2.7배 흔함)- → 자연어 부정문이 협업 톤에 맞음
JSON vs Narrative
- JSON 구조화: 6.5% (32 blocks)
- Narrative: 93.5% (457 blocks)
- → JSON은 정밀 제어가 필요한 시리즈·템플릿 케이스 한정
- → JSON 최다 키: position(105) > count(90) > description(90) > title(87) > labels(64)
🔄 JSON 구조화는 예외 도구 — 결과에서 명세 추출 단계
JSON은 결과물의 시각 요소를 수치화·분석한 후 작성하는 도구. 의뢰 단계에서 머릿속 추측으로 만드는 게 아니다.
워크플로우
- 첫 의뢰 = narrative + 의도·맥락·대본 (의뢰형 brief)
- 결과물 검수·픽스 (Jake 합의)
- 픽스 후 → 그제서야 명세서 추출 가능 (시리즈 통일성·재현용)
- 다음 EP / 시리즈에서 그 명세서를 템플릿으로 활용 (JSON, Raycast 변수 슬롯)
분석에서 본 JSON 6.5% / argument name 262회 같은 패턴은 4단계의 도구. 첫 의뢰에 적용하면 거꾸로다.
🤖 클로드의 이미지 인식 한계
클로드는 텍스트·분석·코드는 강점이지만 이미지 인식률이 OpenAI 모델 대비 낮다 (Jake 짚음 2026-05-13).
함의
- gpt-image-2 결과를 클로드가 검수할 때 시각 요소 해석이 부정확할 수 있음
- 예: 그래프(차트)를 “fragments·decoration”으로 잘못 해석한 사례
- 최종 시각 판단은 Jake가 — 클로드의 단정 X
- 비교 분석에서 “이게 더 낫다”는 결론을 단정하지 말고 균형 잡힌 강·약점 보고 + Jake 결정 받기
시너지 구조
- 클로드 = 맥락·서사·대본·코드·메모리·자동화
- Codex CLI / gpt-image-2 = 이미지 생성·디자인 결정
- Jake = 최종 시각 검수·방향성
📋 트리거 메커니즘 — 이 패러다임을 잊지 않게
단순 메모는 잊힌다. 트리거가 있는 곳에 배치해야 다음 세션에도 발동된다.
3중 트리거 (2026-05-13 구축)
-
refer/codex_cli_imagegen.md 헤더
- Codex CLI 작업 시작 시 룰상 자동 참조
- 5요소 체크리스트 + 디자이너 위임 항목 + JSON 예외 명시
-
표준 brief 템플릿 —
D:/claude/content/codex-test/_templates/brief.txt- BG prompt 작성 시 거기서 시작
- 5요소 빈칸 채우기 형식 — 무의식 회귀 차단
-
자동 메모리 룰 —
.claude/projects/.../memory/feedback_codex_brief_format.md- 매 세션 자동 로드 (잊힘 방지)
- 안티패턴 + 위임 항목 + JSON 예외 + 카피 자유도 명시
-
04 Knowledge 페이지 (이 문서)
- 깊이 보고 싶을 때 들어오는 참고 자료
- 검증 사례 v1~v5 비교가 핵심
📺 시리즈 제작 룰 — 화자 통일 (2026-05-23)
“프롬프트 응용 시리즈”는 화자 1명 고정 — 시리즈 통일 정체성 우선.
트랙별 화자 매핑
- 프롬프트 응용 시리즈 (14·15·16탄 = GPT Image 2 한 줄 프롬프트로 캐릭터/스타일 시리즈) → 이로운 고정
- 쇼츠 큐레이션 (Curation #1·#2·#3) → 듀오(이로운+제이크) 또는 단일 잭
- 뮤직비디오 (MV 트랙) → 별도 결정 (트랙 정체성)
- 일반 정보·실험 → 케이스별
왜
14탄=이로운, 15탄=춘식으로 갈렸을 때 시청자가 같은 시리즈로 인지하기 어려움. “프롬프트 시리즈 = 이로운” 룰 잡으면 채널 정체성 강화. 다양화 효과는 별도 트랙에서 다른 화자로 잡으면 됨.
적용
EP 대본 작성 시 화자 결정 단계를 스킵하고 트랙 룰 따름. 트랙 변경·신규 트랙 출범 시에만 화자 재논의.
📏 시리즈 길이 한계 — EP16 사형선고 학습 (2026-05-24)
Shorts는 평균 37s 범위 유지. 60s 초과는 알고리즘 노출 폭락 신호.
EP16 데이터 (2026-05-24 yt-dlp 비교)
| EP | 길이 | 발행 후 | 조회수 |
|---|---|---|---|
| EP11 에바 | 27s | ~4일 | 1,465 |
| EP12 실루엣 | 40s | — | 1,192 |
| EP14 스케치북 | 42s | ~38h | 1,292 |
| EP15 아르누보 | 44s | ~24h | 1,318 |
| EP16 아트북 | 88s | ~17h | 2 |
EP15는 24h에 1,318, EP16은 17h에 2. 동일 비율이면 ~930 기대. 즉 거의 0 노출.
가설
- 길이 2.4배 → 첫 8초 hook 못 잡으면 시청 지속률 폭락 → Shorts 셔플에서 제외
- 88s = “6캐릭 다 보여주려” 욕심이 역효과
룰
- 목표 35~50s. 6 컷 이내 권장.
- 60s 초과 시 컷 수 또는 라인 길이 감축 필수.
- 4탄 이후 매 EP 발행 직후 yt-dlp로 24h 조회 체크 → 비정상 저조 시 즉시 후속 EP 길이 조정.
🎨 EP 성격별 BG 한글 룰 — 캐릭터·IP vs 데이터 시각화 (2026-05-24)
EP 성격에 따라 BG 텍스트 룰 분기. 단일 룰 적용은 합리화 함정.
캐릭터·IP EP (EP11~16 다수)
- BG는 캐릭터·아트워크가 본문 → 한국어 부재해도 시각으로 인식 가능
- 한글 텍스트는 Remotion 자막 트랙에서 후보정
데이터 시각화 EP (DeepSeek 가격 비교, AI 뉴스 데이터 차트 등)
- BG에 박힌 다이어그램·표·라벨 자체가 본문 → 한글 부재 시 정지 미리보기로 의미 못 읽힘
- 시청자 클릭율 ↓ + Jake 검수 부담 ↑
- 한글 직접 박기: refer §“2026-05-18 한글 letter-by-letter 룰” 적용 (강백호 EP 8/8 정확 렌더 검증)
신호 — 분기 판단
- BG에서 정지 미리보기 1장 켰을 때 “이게 무슨 영상인지” 5초 안에 읽히면 OK, 안 읽히면 한글 보강
합리화 함정 (2026-05-24 발생)
DeepSeek v1 BG에 한글 안 박은 합리화: “시리즈 관례(BG=영문, 한글=Remotion 자막)로 갔다” → Jake “이전에도 이미지에 한글 많이 넣었어. 이건 진짜 습관이야.” 자동 메모리 feedback_no_rationalization.md에 박힘.
AI 영화 포스터 매시업 시리즈 — 자연어 한 줄 패턴 (2026-05-25 신설)
“감독·영화·게임 영감 × 메이저 IP” 매시업 영화 포스터 시리즈. EP1~3 동시 공개로 양산 가능 검증. 디자이너 위임 원칙의 극단적 적용 — brief 풀어쓰기 over-engineering.
시리즈 정체성
- hook 카피:
"[감독]이 [작품]을 만든다면"형태가 시청자 1초 컨셉 인지 - 본질 = 컬쳐쇼크: 시각 융합이 아니라 충돌 큰 매시업이 매력 핵심
- 레이아웃: 화자 X · 이미지 풀스크린 + 자막만 (C 옵션). 채널 advisor 톤 vs 매시업 매번 다른 톤 충돌 회피
양산 prompt = 자연어 한 줄
[감독]이 [작품]을 만든다면 어떤 영화 포스터가 나올지 만들어보자.
또는 캐릭터 매시업:
[작품] 캐릭터로 [영화]를 만든다면 어떤 영화 포스터가 나올지 만들어보자.
ChatGPT가 자동 매핑:
- ECHOES 레이아웃 (거대 얼굴 → 도시 → 작은 실루엣 → 메가구조 → 메인 타이틀)
- 영화제 월계관 (Toronto·Sitges·BFI London·Annecy)
- 크레딧 줄 (실제 영화 협업진 — Robert Yeoman ASC·Randy Newman·Barney Pilling·Adam Stockhausen 등 정확)
- IP 시그니처 (한자 광고판·체크 하오리·빨간 스카프·머리띠 등)
- tagline·메인 타이틀·부제 자동 작문 (영문 + 일본어 한자 듀얼)
- IMAX·COMING SOON·R 등급 영화 포스터 mock 디테일
베이스 IP 선정 룰
시간축 충돌 큼 + 시각 시그니처 강함이 매시업 임팩트 핵심.
| 순위 | IP | 시간축 | 시그니처 |
|---|---|---|---|
| ★★★ | 귀멸의 칼날 | 다이쇼 시대 (1910~20s) | 체크 하오리·오니·일본 한자 |
| ★★★ | 진격거 | medieval | 빨간 스카프·콜로살·벽·ODM |
| ★★ | 슬램덩크 | 1990s 학원 | 빨간 유니폼·5인 라인업 |
| ★★ | 너의 이름은 | 현대 일본 시골 | 황혼·혜성·청춘 |
| ★ | 공각기동대 | 사이버펑크 | (베이스가 sci-fi라 매시업 약함) |
| ★ | 에반게리온 | sci-fi | (베이스가 sci-fi라 매시업 약함) |
매시업 패턴 3종 (검증)
- A. 감독 × 작품 — 작품이 감독 톤화. EP1 진격거×블레이드러너
- B. 감독 × 다른 영화 — 영화가 감독 톤화 (방향 반전). 귀칼 감독 × 블레이드러너
- C. 캐릭 + 감독 × 다른 영화 — 게임/특정 캐릭이 다른 세계관에. 코지마+스네이크×블레이드러너
3축 매트릭스 확장
IP × 감독 영감 × 유명 영화 포스터 레이아웃 = 양산력 ↑↑.
활용도 높은 포스터 레이아웃:
- 매트릭스 (초록 코드·검은 트렌치)
- 인셉션 (도시 거꾸로)
- 다크나이트 (카드·검은)
- 펄프 픽션 (누운 자세·노란)
- 인터스텔라 (우주·블랙홀)
- 매드맥스 (황무지)
- 아키라 (빨간 오토바이)
- 스카페이스 (Tony Montana)
- 탑건 (비행기)
매시업 트레이드오프 — 감독 색깔 vs IP 캐릭 개성
문제: 감독 색깔이 강한 영감(웨스 앤더슨·라라랜드)에서 IP 캐릭 식별이 평면화됨. 슬램덩크×웨스앤더슨 1차 결과 = 5명 정면 응시 무표정, 강백호 빨간머리 외엔 식별 약함.
해결: 표정은 감독 톤(예: 웨스 앤더슨 deadpan)으로 통일 + 자세·소품·헤어·액세서리는 캐릭별 시그니처 명시
검증 매핑 (EP3 슬램덩크×웨스앤더슨):
| 캐릭 | 시그니처 자세 | 소품 |
|---|---|---|
| 강백호 | 양손 머리 위 농구공 (덩크) | 빨간 머리 |
| 서태웅 | 한 손 농구공 + 허리 (쿨) | sleepy 눈 |
| 채치수 | 팔짱+농구공 (캡틴 위엄) | 캡틴 암밴드 |
| 정대만 | 3점 슛 폼 | 흰 머리띠 |
| 송태섭 | 드리블 자세 | 검은 머리띠 + 작은 흉터 (시그니처 누락 시 식별 ↓) |
| 5명 모두 | — | 무표정 deadpan 통일 |
EP 제작 패턴 (89컷 = 3545s)
| 컷 | 내용 | 강화 옵션 |
|---|---|---|
| 1 Hook | 메인 포스터 + “[X]가 [Y]를 만든다면?“ | |
| 2~6 캐릭 | 단독 카드 (4~5명) | 컨셉 해설 narration |
| 7 장면 | 메가구조 / 환경 와이드 | |
| 8 다음편 hook / CTA | 메인 포스터 + “다음 매시업 추천은 댓글로!” | 시청자 참여 CTA |
자막 = narration과 정확 일치 (cut 재배치 시 audio·자막·image 일관성 점검 필수).
양산 작업 표준
- 메인 포스터 = ChatGPT 웹 (사용자 직접) 또는 codex CLI (자동화)
- 캐릭 4
5 + 장면 12 = codex CLI 순차 (D1 룰: 병렬 X) - codex raw 941×1672 → PIL LANCZOS 1080×1920 일괄 업스케일
- TTS 8~9 narration (yena · qwen3-tts) → atempo 1.2 + apad 0.4 (끝 짤림 방지)
- Remotion 컴포지션 (이미지 풀스크린 + 자막 bottom 480 + zoom 켄번스 + 1s fade + 1s hold)
- ffmpeg BGM mix (Funk_Velocity vol 0.05 + loudnorm)
- 업로드 unlisted →
set_public.py로 일괄 공개 전환
EP1~3 검증 결과
| EP | 매시업 | 패턴 | 길이 | URL |
|---|---|---|---|---|
| 1 | 진격거 × 블레이드러너 | A 어둠 사이버펑크 | 34.27s | https://youtu.be/zQMV4P3mVQI |
| 2 | 스파패 × 라라랜드 | A LA 낭만 | 42.4s | https://youtu.be/z56XCiyGkAI |
| 3 | 슬램덩크 × 웨스 앤더슨 | A 파스텔 정적 | 40.1s | https://youtu.be/tDX4SoKCKV4 |
= 1편 어둠 → 2편 낭만 → 3편 파스텔 = 시리즈 톤 양 극단 + 정적 3색 확보.
리스크
- 저작권 회색지대 — IP 캐릭 + mock 영화 포스터 클레임 위험. AI 생성 disclaimer + 음악 라이센스 + IP 노출 정도 조절 필요
- 모방 진입 장벽 낮음 — AI 매시업 5분 가능. 진입 장벽 = 양산 속도 + 시리즈 정체성
- 시리즈 피로감 — 같은 레이아웃 5편 가면 3편부터 임팩트 ↓. 3축 매트릭스(레이아웃 변화)로 보완
- codex UserError 단정 X — 정책/인프라/일시 트래픽/운 모두 가설. 재시도 1회 + 누적 실패 시 단어 조정
정보·뉴스 EP 다양화 패턴 (2026-05-25 딥시크 EP 검증)
문제: 5컷 모두 같은 레이아웃(캐릭터 우측 + 정보 좌측 + 같은 배경 톤)이면 시청자에게 “강의하듯 설명” 인상 = 지루. 매 컷 같은 그림이라 시청 이탈.
해결: 매 컷마다 장소·샷·소품·조명 의도적으로 변경. 캐릭터 시그니처(자켓·머리·ID 카드)는 락.
다양화 매트릭스 (5컷 EP 예시)
| 컷 | 장소 | 샷 사이즈 | 소품·모티프 | 조명·톤 |
|---|---|---|---|---|
| 1 (Hook) | 카페 책상 | 미디엄 | 노트북 + 플로팅 카드 | 따뜻한 카페 |
| 2 (환산) | 사무실 | 7부 풀샷 | 종이 청구서 비교 | 자연광 우디 |
| 3 (단점) | 어두운 스튜디오 | 풀샷 | 메탈 저울 | 어두운 회색 추상 |
| 4 (룰) | 강의실 | 미디엄 풀샷 | 화이트보드 + 마커 | 밝은 자연광 |
| 5 (Outro) | 거실 창가 | 미디엄 풀샷 | 소파 + 시계 + 체크리스트 | 따뜻한 마무리 |
= 같은 캐릭터, 5개 다른 그림. 컷이 바뀔 때마다 “어디로 갔지” 시청자 호기심 유지.
검증 reference
D:/claude/content/remotion/public/images/ep_claude_cache/— 7컷 검증 패턴 (책상/강의실/카페/어두운 방/저울/일몰 갈림길)D:/claude/content/codex-test/deepseek-v4-pro-discount/— 5컷 본 패턴 적용
캐릭터 시그니처 락 룰
다양화는 환경만. 캐릭터는 일관:
- 동일 자켓·셔츠·머리색·머리 길이
- 동일 ID 카드 색·위치 (글자·이름 박지 말 것 — 빈 카드만, 글자 박으면 유치)
- 동일 표정 톤 (advisor)
- ref 이미지 첨부 (
-i yena_ref.png)로 시각 매칭 유도
디바이스 방향 함정 (2026-05-25 딥시크 EP 검증)
문제: 노트북·태블릿·모니터·폰 같은 방향성 있는 디바이스 화면을 시청자 쪽으로 정면 그리면 모순 발생 — “화자가 사용 중인데 화면이 시청자 쪽” = 노트북이 거꾸로 배치된 듯한 부자연. (이전 ep_claude_cache에도 같은 함정 재발 — Jake 명시 지적)
해결:
- 디바이스는 화자 쪽 정상 방향 (시청자에게는 노트북 뒷면·키보드만 살짝 보임)
- 정보는 별도 플로팅 UI 카드 / 말풍선 / AR 오버레이로 분리
- anime 스타일에서 자연스럽게 디바이스 위에 떠 있는 카드 표현 가능
Prompt 패턴
- 노트북은 예나 쪽 정상 방향 — 시청자에게는 노트북 측면 또는 뒷면이 보임
(키보드·터치패드 살짝 보이고, 화면은 예나 쪽으로). 노트북 화면 자체에는 텍스트 박지 말 것
- 노트북 위 공중에 플로팅 카드 두 장 (anime 스타일의 떠있는 UI 카드, 살짝 그림자)
대안: 정보 시각화 EP는 아예 디바이스 빼고 종이 청구서·저울·화이트보드 등 방향 함정 없는 소품으로 대체.
이전 EP 구도 회피 룰 (2026-05-25)
새 EP 시작 시 이전 EP 컷 구도와 겹침 검토 의무. 같은 시리즈 안 다양화(위 매트릭스)는 EP 내부 룰, 이건 EP 간 룰.
- 새 EP prompt 작성 전 vault wiki +
D:/claude/content/remotion/public/images/최근 5~10 EP BG 1차 리뷰 - 겹치는 구도 발견 시 다른 장소·다른 소품·다른 조명으로 차별화
- “거실 소파 + 시계 + 체크리스트” 같은 마무리 구도가 여러 EP에 반복되면 시청자에게 채널 패턴 노출 = 신선도 ↓ (Jake “이전 작업과 구도가 비슷한 건 좀 단점” 지적)
공유용 prompt 단순화 룰 (2026-05-25 papercut 메카 EP 검증)
문제: 영상 댓글·description에 작업용 풀 prompt(50줄 시그니처 디테일)를 그대로 박으면 시청자 진입장벽 ↑. 시청자는 “어디 바꿔야 하지?” 헷갈리고 시도 포기. (Jake 명시 지적: “다른 캐릭터로 사용해보라고 주는 건데 취지에 안 맞음”)
해결: 공유용 prompt = 본문 핵심만 + 교체 자리 1개 명시. 시그니처·비율·디오라마 구성 등 디테일 모두 제거.
공유 prompt 템플릿 (Jake 검증 패턴)
9:16 세로 papercut diorama 일러스트레이션.
주제 = [원하는 캐릭터 혹은 메카닉]
부드러운 페이퍼컷 레이어드 일러스트레이션 스타일.
페이퍼크래프트 디오라마 미학 + 부드러운 둥근 형태 + 따뜻한 톤.
겹친 종이 레이어로 가시적 깊이 + 미묘한 그림자
+ 레이저 컷 카드스톡 가장자리.
[ ] 대괄호 부분만 바꿔서 사용하시면 됩니다.
= 본문 5~6줄 + 교체 자리 1개 + 사용법 1줄. 진입장벽 ↓.
영상 Hook ↔ 공유 prompt 매칭 룰 (2026-05-25)
문제: 영상 hook에서 “한 줄 프롬프트로 만들었어요”라고 단정했는데, 실제 작업 prompt는 시그니처 디테일 50줄 추가본. 시청자가 댓글의 공유 prompt를 따라해도 영상과 다른 결과 = 사기 톤·신뢰 깨짐.
해결: hook 표현과 공유 prompt 형태를 일치시킬 것.
- hook이 “한 줄”이면 → 공유 prompt도 한 줄에 가까워야 (단순)
- hook이 “디테일 prompt”면 → 공유 prompt도 풀 본문이어야
- 작업 단계에서 미리 결정: 한 줄 hook 시리즈 → 톱급 IP로 IP명 한 줄만으로 생성 (시그니처 디테일 X) → Optimus 검증 패턴 차용
작업 단계 룰
- “한 줄 prompt” hook EP는 작업도 한 줄로 진행 (시그니처 디테일 추가 X)
- 톱급 글로벌 IP (건담·에반게리온·트랜스포머 등)는 IP명 한 줄로 80% 가능 (Optimus 시안 검증)
- 마니악 IP는 시그니처 추가 필요 → 그러면 hook도 “디테일 prompt” 톤으로
Why: 2026-05-25 메카 papercut EP에서 hook “한 줄 프롬프트”와 실제 작업 prompt(시그니처 50줄)이 불일치. Jake 명시 지적 “영상에서 소개하는 이미지들은 그렇게 만든 게 아니잖아”. 시청자가 댓글 prompt를 따라도 영상과 다른 결과 = 신뢰 X. hook ↔ 공유 prompt ↔ 작업 prompt 3자 일치성 필수.
🎯 쇼츠 기본 형식 v1 (2026-05-26 확정 — ClaudeNotArchitect20260526 패턴)
Jake가 “특별 요구 없으면 이 형식을 쇼츠 기본”으로 확정. 다음 EP 시작 시 별도 지시 없으면 이 템플릿 적용.
기본 명세
| 항목 | 기본값 |
|---|---|
| 화자 | 예나 (yena_ref.png) |
| 일러스트 톤 | 성숙한 세미리얼 (2026-05-31 갱신) — semi-realistic, mature/natural adult proportions, natural eye size, photoreal skin shading, soft cinematic rendering. ⚠️ highly detailed animation illustration·큰 눈 키워드는 소녀만화(shoujo) 톤 유발 → NOT shoujo/manga, NOT oversized eyes 명시로 제거 |
| 컷 수 | 8컷 (Hook + 본문 6 + Outro) |
| 영상 길이 | 35~50s (1.2x 가속 후) |
| TTS | Qwen3 예나 + ffmpeg atempo=1.2 + cut08 apad=pad_dur=0.5 |
| BGM | AITipsVibes.mp3 재사용 (volume 0.10, 1초 fade-in/out) |
| 자막 | 검정 박스 bottom 650, 흰 텍스트, Pretendard, lineHeight 1.4 |
| 컷별 다양화 | 장소·샷 사이즈·시선·자세 매트릭스 (각 컷 다른 환경·각도) |
| 카메라 응시 | Hook (cut1) + Outro (cut8)만 정면, 본문 6컷은 상황 몰입 (태블릿·화이트보드·카드·옆 가상 동료 응시) |
| 캐릭터 시그니처 | 베이지 자켓 + 흰 셔츠 + 빈 옐로우 ID 카드 (글자 없음/도형) + 긴 갈색 웨이브(half-up) + 앰버브라운 눈 + 골드 주얼리 |
| 캐릭터 ref | 캐릭터 시트 통째로 -i ref (yena_sheet_ref.png) — 단독 컷보다 다각도·표정·복장 정보 풍부해 8컷 1패스 일관성 강함. 단독 컷 추출 불필요 (2026-05-31 검증, Jake 지적) |
| 디바이스 | 화자 쪽 정상 방향 + 정보는 플로팅 UI 카드로 분리 |
| 한글 | letter-by-letter 자모 정확 (Pretendard·Noto Sans KR) |
| 업로드 | unlisted (일부공개) → Jake 검증 후 공개 |
| Description | 출처 · 핵심 · 룰 · 인용문 + shorts 태그 |
다양화 매트릭스 8컷 예시 (Claude-architect EP)
| 컷 | 장소·샷 | 시선 |
|---|---|---|
| 1 Hook | 어두운 사무실 모니터 + alert | 정면 응시 (advisor hook) |
| 2 도입 | 카페 책상 클로즈업 | 태블릿 몰입 |
| 3 문제 | 강의실 화이트보드 옆모습 풀샷 | 화이트보드 향함 |
| 4 결과 | 어두운 회의실 와이드 + 빈 의자 | 빈 의자 응시 |
| 5 룰 1·2 | 사무실 책상 over-the-shoulder | 카드 내려봄 |
| 6 룰 3·4 | 회의실 둥근 테이블 미디엄 측면 | 옆 가상 동료 |
| 7 인용 | 공항 와이드 옆모습 + 가방 | 창밖 사색 |
| 8 Outro | 거실 창가 미디엄 정면 | 정면 응시 (advisor 마무리) |
Remotion 컴포지션 패턴
src/news/{TopicYYMMDD}.tsx— ClaudeCacheTrap20260430·ClaudeNotArchitect20260526 패턴 차용- public/audio/{topic}/ + public/images/{topic}/ 폴더 분리
- BgmTrack 컴포넌트 + Scene 컴포넌트 (Audio + Img + 자막)
- PAD_PER_CUT 0.18s, zoomMax 1.06 (Outro 1.03), fadeIn/Out 6프레임
변경 트리거
- Jake가 명시적으로 “이 EP는 다른 톤으로” / “papercut으로” / “다양화 빼고 정면만” 등 지시 시 일회성 변경
- 시리즈 누적 학습으로 기본 형식 자체가 v2로 진화하면 이 섹션 갱신
검증 EP
D:/claude/content/remotion/src/news/ClaudeNotArchitect20260526.tsx— 원본 템플릿https://youtu.be/84RdiP_hzpc— 첫 발행 (2026-05-26 unlisted)
관련
- 원본 분석 저장소: https://github.com/EvoLinkAI/awesome-gpt-image-2-API-and-Prompts (CC0)
- 보조 큐레이션: https://github.com/YouMind-OpenLab/awesome-gpt-image-2 (CC BY 4.0)
- Codex CLI 가이드:
D:/ComfyUI_windows_portable/refer/codex_cli_imagegen.md - 표준 brief 템플릿:
D:/claude/content/codex-test/_templates/brief.txt - 자동 메모리 룰:
.claude/projects/D--ComfyUI-windows-portable/memory/feedback_codex_brief_format.md - 첫 검증 EP: 2026-05-13 GPT Image 2 TOP 5 (Cut 1 v1→v5 사이클)
