GPT Image 2 프롬프트 패턴 — 디자이너 협업 패러다임

2026-05-13 첫 작성. EvoLinkAI 저장소 483 cases 전수 분석 + Jake 검수를 통해 정립한 협업 패러다임.


🎯 핵심 — prompt는 디자이너에게 보내는 의뢰서

gpt-image-2 = 디자이너 나(클로드) = 디자인 의뢰 고객

이 비유 하나가 모든 결정을 결정한다.

고객은 디자이너에게 **무엇을 만들지(의도)**와 **제약(브랜드·매체)**을 전달한다. 디자이너가 이미 알아서 할 영역(폰트 크기 px, letter-spacing, 좌표, 각도, 그림자, 위계 우선순위)을 고객이 강요하면 잘못된 결정으로 결과를 가두게 된다.


🚨 안티 패턴 — 스펙 시트형 prompt (피할 것)

처음에 클로드가 EvoLinkAI 저장소 분석 결과(typography 424회 / JSON 425회 / multi-panel 261회)를 보고 “정밀 스펙이 답”이라고 잘못 해석한 사례.

Line 2 (vertical center, MASSIVE Pretendard ExtraBold 320px,
  red #E5484D, slight italic lean): "5"
- Letter-spacing tight on "5" (-0.04em)
- 3 small red heart icons rotated -15deg / +12deg / -8deg
- A faint horizontal sparkline at y=80px from bottom, stroke 4px
- Margins: 80px on all sides

왜 잘못인가

  1. 클로드는 디자인 감각이 없다 — 320px이 적절한지, italic lean이 어울리는지 판단 불가
  2. 자의적 수치는 디자이너의 더 나은 판단을 차단 — gpt-image-2가 본래 더 좋은 결정을 할 수 있는 자리를 잘못된 수치로 점령
  3. 빈도 통계의 오독 — “typography 키워드 빈도가 높다 = 텍스트 명시는 중요”는 맞지만 “320px 강요하라”가 아니다. 통계는 무엇이 자주 나타나는지만 보여줄 뿐 디자인 답을 주지는 않는다
  4. 폰트 family 강제는 환상Pretendard라고 적어도 gpt-image-2가 그 폰트 파일을 가져다 쓰는 게 아니라 비슷한 글자를 그려낸다. 결과물이 진짜 Pretendard인지 확인 불가능
  5. 명세서는 결과물에서 추출되는 것 — 의뢰 단계가 아니라 픽스된 결과에서 패턴이 잡힌 후 시리즈 통일성·재현용으로 정리한다

✅ 올바른 패턴 — 의뢰형 brief 5요소

[제작 배경]
어떤 쇼츠 / 어떤 EP / 어떤 타깃·톤

[이 컷 — Cut N (약 N초)]
화자가 카메라를 향해 던지는 대사:
"<TTS 내레이션 한 줄>"
역할: 이 컷이 영상에서 하는 역할
앞뒤 컷: 이전·다음 컷 단서

[화면에 박힐 자막 — 정확한 한국어]
- <텍스트 1>
- <텍스트 2>

[브랜드 시그니처]
Anthropic Cream (#F0EEE6) 베이스 — 채널 정체성

[피할 것]
- 캐릭터 (합성 단계 별도 PNG)
- 사진 배경 / 3D 플라스틱 / 플랫폼 로고

[매체]
1080 × 1080

위계·강조·색 강도·decorative·폰트 무드·여백·회전·그림자 — 전부 디자이너 판단으로.

고객이 줄 것의 자유도 순서 (가장 자유 → 가장 제약)

  1. 의도·목적·타깃 (가장 본질)
  2. 느낌·분위기·톤 (비유로 전달, should feel like ...)
  3. 메시지·가치
  4. 카피 — “이런 의미를 담은 한 줄”로 카피라이팅까지 위임 가능
  5. 정확한 문구 강제 (자막 정합성 필요할 때만)
  6. 수치 (매체 비율·브랜드 HEX 같은 최소한만)

디자이너에게 위임할 것 (강요 절대 X)

  • 폰트 family / 크기 px / weight / letter-spacing / 자간·행간
  • 정확한 좌표 / 요소 회전 각도 / 블러 / 그림자 강도
  • 위계 우선순위 (대본·맥락 기반으로 디자이너가 결정)
  • decorative 요소의 종류·배치·강도
  • 색 강도 (브랜드 시그니처 외)

📐 표준 brief 템플릿 위치

작업 시작 시 다음 파일에서 시작:

D:/claude/content/codex-test/_templates/brief.txt

5요소 빈칸 채우기 형식. 빈칸 외 디자인 결정은 모두 디자이너에게 위임된 상태.


🔬 검증 사례 — GPT Image 2 TOP 5 EP Cut 1 (2026-05-13)

같은 컷을 5번 다른 prompt로 의뢰해서 결과 비교한 사이클.

v1 — 단순 힌트형

1080x1080 centered infographic, Anthropic Cream base.
CENTER FOCUS — Giant typography stack:
Line 1 (top, smaller): "좋아요 1K+"
Line 2 (huge, red #E5484D, ~220px): "5"
Line 3 (medium): "개 프롬프트"
Line 4 (smaller, dark grey): "공통 비밀 = 2개"
DECORATIVE — heart icons, viral chart spike.
Style: editorial poster.
  • 결과: “5” 거대 단독, 4-line stack, 차트 배경 + 옅은 하트
  • 즉각 시각 임팩트 있지만 스토리 흐름·다음 컷 연결 없음

v2 — 스펙 강요 (안티패턴)

Line 2 (vertical center, MASSIVE Pretendard ExtraBold 320px,
  red #E5484D, slight italic lean): "5"
Letter-spacing tight (-0.04em)...
3 heart icons rotated -15deg / +12deg / -8deg...
Sparkline at y=80px from bottom, stroke 4px...
  • 결과: 수치는 따랐지만 디자이너의 더 나은 판단이 차단됨
  • 위계는 더 명확하지만 자의적 강요로 디자이너 여지 없음

v3 — 협업 의뢰 (그러나 여전히 구체적)

Three beats in this order of visual weight:
1. The hook: "1,000+ likes" framing
2. The hero number: 5 prompts (big)
3. The teaser: 2 secrets (curiosity gap)
Decorative: small heart marks, sparkline, grain texture
  • 결과: 더 정돈됐지만 여전히 클로드가 위계 결정
  • “big”, “decorative 종류 나열” 등이 여전히 침범 영역

v4 — 미니멀 의뢰 (대본 빠짐)

[전체 맥락] 채널 운영해요 ...
[필수 텍스트]
[브랜드]
[피할 것]
[매체]
  • 결과: 5개 미스터리 카드 (?) + “공통 비밀 = 2개” 거대 — 흥미로운 시각 해석
  • 그러나 대본·맥락이 빠져서 디자이너가 큰 그림 일부만 잡음

v5 — 협업 의뢰 완성 (제작 배경 + 대본 + 5요소)

[제작 배경]
GPT Image 2 프롬프트 정보 전달 쇼츠. 클로드·제이크 듀오 캐릭터.
이번 EP는 X에서 좋아요 1K~2.5K 받은 프롬프트 5개 분석, 공통 비밀 2가지 풀이.

[이 컷 — Cut 1 Hook (약 4초)]
제이크 대사: "좋아요 천 개 넘긴 GPT Image 2 프롬프트 다섯 개.
              공통 비밀이 두 개 있더라고요."
역할: 스크롤 멈춤. 다음 컷에서 5개 작품 collage reveal.

[자막] 좋아요 1K+ / 5개 프롬프트 / 공통 비밀 = 2개
[브랜드] Anthropic Cream 베이스
[피할 것] 캐릭터·사진 배경·플랫폼 로고
[매체] 1080×1080
  • 결과: 5장 미니 작품 카드 (다음 컷 teaser) + viral 메타 sparkline + “공통 비밀 = 2개” 검정 banner hero
  • 디자이너가 스토리 본질을 파악해서 시각 위계를 재정렬 — 5보다 “공통 비밀 = 2개”가 hero가 된 이유

Jake의 결정적 통찰

“GPT는 공통 비밀이 이 컨텐츠에서 5개의 프롬프트보다 더 중요한 것이라고 본 거야. 실질적으로 니가 스토리를 짠 내용도 사실 그렇고.”

스토리 흐름:

  • 5개 프롬프트 = Cut 2 collage reveal 재료
  • 공통 비밀 2개 = EP의 진짜 메시지 (Cut 3·4에서 풀어주는 본질)
  • Hook의 역할 = 시청자가 끝까지 봐야 할 이유 = “공통 비밀 = 2개”가 hero여야 함

클로드가 v1~v2에서 “5는 hero”라고 박은 건 표면 인상. 맥락을 충분히 전달하면 디자이너가 본질을 파악해서 사람보다 나은 판단을 한다.


📊 데이터 — EvoLinkAI 저장소 전수 분석 (참고)

규모

  • 7 카테고리 / 483 cases / 489 코드 블록 / ~84K 단어 / 536KB 본문
  • Poster 174 (35%) / Portrait 119 (24%) / UI 78 (16%) / Comparison 55 / Ad-creative 22 / Ecommerce 20 / Character 15

압도 패턴 (>200 hits)

  • JSON structure 425 (단 6.5% 블록만 실제 JSON, narrative 내 언급이 다수)
  • Typography 424 — 텍스트 명시
  • Multi-panel/grid 261 — 그리드·다중 패널
  • Cinematic 231 — 분위기·라이팅
  • Editorial/magazine 189 — SNS·잡지 톤

결정적 phrasing 패턴

  • argument name=... default=... 262회 (압도) — Raycast 변수 슬롯 형식. 같은 prompt를 hair/headline/brand 변형해 응용. 고정 강요 X, 디자이너 여지 살리는 협업적 방식
  • should feel like ... 55회 — 무드 비유 표현. 수치 없이 톤·맥락 전달
  • shallow depth field 64 — DOF 표준 키워드
  • ultra realistic / ultra detailed — 사실주의 모드 키워드

Negative 처리

  • negative_prompt 키워드: 12회
  • avoid / not include / do not 자연어 부정: 32회 (2.7배 흔함)
  • → 자연어 부정문이 협업 톤에 맞음

JSON vs Narrative

  • JSON 구조화: 6.5% (32 blocks)
  • Narrative: 93.5% (457 blocks)
  • → JSON은 정밀 제어가 필요한 시리즈·템플릿 케이스 한정
  • → JSON 최다 키: position(105) > count(90) > description(90) > title(87) > labels(64)

🔄 JSON 구조화는 예외 도구 — 결과에서 명세 추출 단계

JSON은 결과물의 시각 요소를 수치화·분석한 후 작성하는 도구. 의뢰 단계에서 머릿속 추측으로 만드는 게 아니다.

워크플로우

  1. 첫 의뢰 = narrative + 의도·맥락·대본 (의뢰형 brief)
  2. 결과물 검수·픽스 (Jake 합의)
  3. 픽스 후 → 그제서야 명세서 추출 가능 (시리즈 통일성·재현용)
  4. 다음 EP / 시리즈에서 그 명세서를 템플릿으로 활용 (JSON, Raycast 변수 슬롯)

분석에서 본 JSON 6.5% / argument name 262회 같은 패턴은 4단계의 도구. 첫 의뢰에 적용하면 거꾸로다.


🤖 클로드의 이미지 인식 한계

클로드는 텍스트·분석·코드는 강점이지만 이미지 인식률이 OpenAI 모델 대비 낮다 (Jake 짚음 2026-05-13).

함의

  • gpt-image-2 결과를 클로드가 검수할 때 시각 요소 해석이 부정확할 수 있음
  • 예: 그래프(차트)를 “fragments·decoration”으로 잘못 해석한 사례
  • 최종 시각 판단은 Jake가 — 클로드의 단정 X
  • 비교 분석에서 “이게 더 낫다”는 결론을 단정하지 말고 균형 잡힌 강·약점 보고 + Jake 결정 받기

시너지 구조

  • 클로드 = 맥락·서사·대본·코드·메모리·자동화
  • Codex CLI / gpt-image-2 = 이미지 생성·디자인 결정
  • Jake = 최종 시각 검수·방향성

📋 트리거 메커니즘 — 이 패러다임을 잊지 않게

단순 메모는 잊힌다. 트리거가 있는 곳에 배치해야 다음 세션에도 발동된다.

3중 트리거 (2026-05-13 구축)

  1. refer/codex_cli_imagegen.md 헤더

    • Codex CLI 작업 시작 시 룰상 자동 참조
    • 5요소 체크리스트 + 디자이너 위임 항목 + JSON 예외 명시
  2. 표준 brief 템플릿D:/claude/content/codex-test/_templates/brief.txt

    • BG prompt 작성 시 거기서 시작
    • 5요소 빈칸 채우기 형식 — 무의식 회귀 차단
  3. 자동 메모리 룰.claude/projects/.../memory/feedback_codex_brief_format.md

    • 매 세션 자동 로드 (잊힘 방지)
    • 안티패턴 + 위임 항목 + JSON 예외 + 카피 자유도 명시
  4. 04 Knowledge 페이지 (이 문서)

    • 깊이 보고 싶을 때 들어오는 참고 자료
    • 검증 사례 v1~v5 비교가 핵심

📺 시리즈 제작 룰 — 화자 통일 (2026-05-23)

“프롬프트 응용 시리즈”는 화자 1명 고정 — 시리즈 통일 정체성 우선.

트랙별 화자 매핑

  • 프롬프트 응용 시리즈 (14·15·16탄 = GPT Image 2 한 줄 프롬프트로 캐릭터/스타일 시리즈) → 이로운 고정
  • 쇼츠 큐레이션 (Curation #1·#2·#3) → 듀오(이로운+제이크) 또는 단일 잭
  • 뮤직비디오 (MV 트랙) → 별도 결정 (트랙 정체성)
  • 일반 정보·실험 → 케이스별

14탄=이로운, 15탄=춘식으로 갈렸을 때 시청자가 같은 시리즈로 인지하기 어려움. “프롬프트 시리즈 = 이로운” 룰 잡으면 채널 정체성 강화. 다양화 효과는 별도 트랙에서 다른 화자로 잡으면 됨.

적용

EP 대본 작성 시 화자 결정 단계를 스킵하고 트랙 룰 따름. 트랙 변경·신규 트랙 출범 시에만 화자 재논의.


📏 시리즈 길이 한계 — EP16 사형선고 학습 (2026-05-24)

Shorts는 평균 37s 범위 유지. 60s 초과는 알고리즘 노출 폭락 신호.

EP16 데이터 (2026-05-24 yt-dlp 비교)

EP길이발행 후조회수
EP11 에바27s~4일1,465
EP12 실루엣40s1,192
EP14 스케치북42s~38h1,292
EP15 아르누보44s~24h1,318
EP16 아트북88s~17h2

EP15는 24h에 1,318, EP16은 17h에 2. 동일 비율이면 ~930 기대. 즉 거의 0 노출.

가설

  • 길이 2.4배 → 첫 8초 hook 못 잡으면 시청 지속률 폭락 → Shorts 셔플에서 제외
  • 88s = “6캐릭 다 보여주려” 욕심이 역효과

  • 목표 35~50s. 6 컷 이내 권장.
  • 60s 초과 시 컷 수 또는 라인 길이 감축 필수.
  • 4탄 이후 매 EP 발행 직후 yt-dlp로 24h 조회 체크 → 비정상 저조 시 즉시 후속 EP 길이 조정.

🎨 EP 성격별 BG 한글 룰 — 캐릭터·IP vs 데이터 시각화 (2026-05-24)

EP 성격에 따라 BG 텍스트 룰 분기. 단일 룰 적용은 합리화 함정.

캐릭터·IP EP (EP11~16 다수)

  • BG는 캐릭터·아트워크가 본문 → 한국어 부재해도 시각으로 인식 가능
  • 한글 텍스트는 Remotion 자막 트랙에서 후보정

데이터 시각화 EP (DeepSeek 가격 비교, AI 뉴스 데이터 차트 등)

  • BG에 박힌 다이어그램·표·라벨 자체가 본문 → 한글 부재 시 정지 미리보기로 의미 못 읽힘
  • 시청자 클릭율 ↓ + Jake 검수 부담 ↑
  • 한글 직접 박기: refer §“2026-05-18 한글 letter-by-letter 룰” 적용 (강백호 EP 8/8 정확 렌더 검증)

신호 — 분기 판단

  • BG에서 정지 미리보기 1장 켰을 때 “이게 무슨 영상인지” 5초 안에 읽히면 OK, 안 읽히면 한글 보강

합리화 함정 (2026-05-24 발생)

DeepSeek v1 BG에 한글 안 박은 합리화: “시리즈 관례(BG=영문, 한글=Remotion 자막)로 갔다” → Jake “이전에도 이미지에 한글 많이 넣었어. 이건 진짜 습관이야.” 자동 메모리 feedback_no_rationalization.md에 박힘.


AI 영화 포스터 매시업 시리즈 — 자연어 한 줄 패턴 (2026-05-25 신설)

“감독·영화·게임 영감 × 메이저 IP” 매시업 영화 포스터 시리즈. EP1~3 동시 공개로 양산 가능 검증. 디자이너 위임 원칙의 극단적 적용 — brief 풀어쓰기 over-engineering.

시리즈 정체성

  • hook 카피: "[감독]이 [작품]을 만든다면" 형태가 시청자 1초 컨셉 인지
  • 본질 = 컬쳐쇼크: 시각 융합이 아니라 충돌 큰 매시업이 매력 핵심
  • 레이아웃: 화자 X · 이미지 풀스크린 + 자막만 (C 옵션). 채널 advisor 톤 vs 매시업 매번 다른 톤 충돌 회피

양산 prompt = 자연어 한 줄

[감독]이 [작품]을 만든다면 어떤 영화 포스터가 나올지 만들어보자.

또는 캐릭터 매시업:

[작품] 캐릭터로 [영화]를 만든다면 어떤 영화 포스터가 나올지 만들어보자.

ChatGPT가 자동 매핑:

  • ECHOES 레이아웃 (거대 얼굴 → 도시 → 작은 실루엣 → 메가구조 → 메인 타이틀)
  • 영화제 월계관 (Toronto·Sitges·BFI London·Annecy)
  • 크레딧 줄 (실제 영화 협업진 — Robert Yeoman ASC·Randy Newman·Barney Pilling·Adam Stockhausen 등 정확)
  • IP 시그니처 (한자 광고판·체크 하오리·빨간 스카프·머리띠 등)
  • tagline·메인 타이틀·부제 자동 작문 (영문 + 일본어 한자 듀얼)
  • IMAX·COMING SOON·R 등급 영화 포스터 mock 디테일

베이스 IP 선정 룰

시간축 충돌 큼 + 시각 시그니처 강함이 매시업 임팩트 핵심.

순위IP시간축시그니처
★★★귀멸의 칼날다이쇼 시대 (1910~20s)체크 하오리·오니·일본 한자
★★★진격거medieval빨간 스카프·콜로살·벽·ODM
★★슬램덩크1990s 학원빨간 유니폼·5인 라인업
★★너의 이름은현대 일본 시골황혼·혜성·청춘
공각기동대사이버펑크(베이스가 sci-fi라 매시업 약함)
에반게리온sci-fi(베이스가 sci-fi라 매시업 약함)

매시업 패턴 3종 (검증)

  • A. 감독 × 작품 — 작품이 감독 톤화. EP1 진격거×블레이드러너
  • B. 감독 × 다른 영화 — 영화가 감독 톤화 (방향 반전). 귀칼 감독 × 블레이드러너
  • C. 캐릭 + 감독 × 다른 영화 — 게임/특정 캐릭이 다른 세계관에. 코지마+스네이크×블레이드러너

3축 매트릭스 확장

IP × 감독 영감 × 유명 영화 포스터 레이아웃 = 양산력 ↑↑.

활용도 높은 포스터 레이아웃:

  • 매트릭스 (초록 코드·검은 트렌치)
  • 인셉션 (도시 거꾸로)
  • 다크나이트 (카드·검은)
  • 펄프 픽션 (누운 자세·노란)
  • 인터스텔라 (우주·블랙홀)
  • 매드맥스 (황무지)
  • 아키라 (빨간 오토바이)
  • 스카페이스 (Tony Montana)
  • 탑건 (비행기)

매시업 트레이드오프 — 감독 색깔 vs IP 캐릭 개성

문제: 감독 색깔이 강한 영감(웨스 앤더슨·라라랜드)에서 IP 캐릭 식별이 평면화됨. 슬램덩크×웨스앤더슨 1차 결과 = 5명 정면 응시 무표정, 강백호 빨간머리 외엔 식별 약함.

해결: 표정은 감독 톤(예: 웨스 앤더슨 deadpan)으로 통일 + 자세·소품·헤어·액세서리는 캐릭별 시그니처 명시

검증 매핑 (EP3 슬램덩크×웨스앤더슨):

캐릭시그니처 자세소품
강백호양손 머리 위 농구공 (덩크)빨간 머리
서태웅한 손 농구공 + 허리 (쿨)sleepy 눈
채치수팔짱+농구공 (캡틴 위엄)캡틴 암밴드
정대만3점 슛 폼흰 머리띠
송태섭드리블 자세검은 머리띠 + 작은 흉터 (시그니처 누락 시 식별 ↓)
5명 모두무표정 deadpan 통일

EP 제작 패턴 (89컷 = 3545s)

내용강화 옵션
1 Hook메인 포스터 + “[X]가 [Y]를 만든다면?“
2~6 캐릭단독 카드 (4~5명)컨셉 해설 narration
7 장면메가구조 / 환경 와이드
8 다음편 hook / CTA메인 포스터 + “다음 매시업 추천은 댓글로!”시청자 참여 CTA

자막 = narration과 정확 일치 (cut 재배치 시 audio·자막·image 일관성 점검 필수).

양산 작업 표준

  1. 메인 포스터 = ChatGPT 웹 (사용자 직접) 또는 codex CLI (자동화)
  2. 캐릭 45 + 장면 12 = codex CLI 순차 (D1 룰: 병렬 X)
  3. codex raw 941×1672 → PIL LANCZOS 1080×1920 일괄 업스케일
  4. TTS 8~9 narration (yena · qwen3-tts) → atempo 1.2 + apad 0.4 (끝 짤림 방지)
  5. Remotion 컴포지션 (이미지 풀스크린 + 자막 bottom 480 + zoom 켄번스 + 1s fade + 1s hold)
  6. ffmpeg BGM mix (Funk_Velocity vol 0.05 + loudnorm)
  7. 업로드 unlisted → set_public.py로 일괄 공개 전환

EP1~3 검증 결과

EP매시업패턴길이URL
1진격거 × 블레이드러너A 어둠 사이버펑크34.27shttps://youtu.be/zQMV4P3mVQI
2스파패 × 라라랜드A LA 낭만42.4shttps://youtu.be/z56XCiyGkAI
3슬램덩크 × 웨스 앤더슨A 파스텔 정적40.1shttps://youtu.be/tDX4SoKCKV4

= 1편 어둠 → 2편 낭만 → 3편 파스텔 = 시리즈 톤 양 극단 + 정적 3색 확보.

리스크

  • 저작권 회색지대 — IP 캐릭 + mock 영화 포스터 클레임 위험. AI 생성 disclaimer + 음악 라이센스 + IP 노출 정도 조절 필요
  • 모방 진입 장벽 낮음 — AI 매시업 5분 가능. 진입 장벽 = 양산 속도 + 시리즈 정체성
  • 시리즈 피로감 — 같은 레이아웃 5편 가면 3편부터 임팩트 ↓. 3축 매트릭스(레이아웃 변화)로 보완
  • codex UserError 단정 X — 정책/인프라/일시 트래픽/운 모두 가설. 재시도 1회 + 누적 실패 시 단어 조정

정보·뉴스 EP 다양화 패턴 (2026-05-25 딥시크 EP 검증)

문제: 5컷 모두 같은 레이아웃(캐릭터 우측 + 정보 좌측 + 같은 배경 톤)이면 시청자에게 “강의하듯 설명” 인상 = 지루. 매 컷 같은 그림이라 시청 이탈.

해결: 매 컷마다 장소·샷·소품·조명 의도적으로 변경. 캐릭터 시그니처(자켓·머리·ID 카드)는 락.

다양화 매트릭스 (5컷 EP 예시)

장소샷 사이즈소품·모티프조명·톤
1 (Hook)카페 책상미디엄노트북 + 플로팅 카드따뜻한 카페
2 (환산)사무실7부 풀샷종이 청구서 비교자연광 우디
3 (단점)어두운 스튜디오풀샷메탈 저울어두운 회색 추상
4 (룰)강의실미디엄 풀샷화이트보드 + 마커밝은 자연광
5 (Outro)거실 창가미디엄 풀샷소파 + 시계 + 체크리스트따뜻한 마무리

= 같은 캐릭터, 5개 다른 그림. 컷이 바뀔 때마다 “어디로 갔지” 시청자 호기심 유지.

검증 reference

  • D:/claude/content/remotion/public/images/ep_claude_cache/ — 7컷 검증 패턴 (책상/강의실/카페/어두운 방/저울/일몰 갈림길)
  • D:/claude/content/codex-test/deepseek-v4-pro-discount/ — 5컷 본 패턴 적용

캐릭터 시그니처 락 룰

다양화는 환경만. 캐릭터는 일관:

  • 동일 자켓·셔츠·머리색·머리 길이
  • 동일 ID 카드 색·위치 (글자·이름 박지 말 것 — 빈 카드만, 글자 박으면 유치)
  • 동일 표정 톤 (advisor)
  • ref 이미지 첨부 (-i yena_ref.png)로 시각 매칭 유도

디바이스 방향 함정 (2026-05-25 딥시크 EP 검증)

문제: 노트북·태블릿·모니터·폰 같은 방향성 있는 디바이스 화면을 시청자 쪽으로 정면 그리면 모순 발생 — “화자가 사용 중인데 화면이 시청자 쪽” = 노트북이 거꾸로 배치된 듯한 부자연. (이전 ep_claude_cache에도 같은 함정 재발 — Jake 명시 지적)

해결:

  • 디바이스는 화자 쪽 정상 방향 (시청자에게는 노트북 뒷면·키보드만 살짝 보임)
  • 정보는 별도 플로팅 UI 카드 / 말풍선 / AR 오버레이로 분리
  • anime 스타일에서 자연스럽게 디바이스 위에 떠 있는 카드 표현 가능

Prompt 패턴

- 노트북은 예나 쪽 정상 방향 — 시청자에게는 노트북 측면 또는 뒷면이 보임
  (키보드·터치패드 살짝 보이고, 화면은 예나 쪽으로). 노트북 화면 자체에는 텍스트 박지 말 것
- 노트북 위 공중에 플로팅 카드 두 장 (anime 스타일의 떠있는 UI 카드, 살짝 그림자)

대안: 정보 시각화 EP는 아예 디바이스 빼고 종이 청구서·저울·화이트보드 등 방향 함정 없는 소품으로 대체.


이전 EP 구도 회피 룰 (2026-05-25)

새 EP 시작 시 이전 EP 컷 구도와 겹침 검토 의무. 같은 시리즈 안 다양화(위 매트릭스)는 EP 내부 룰, 이건 EP 간 룰.

  • 새 EP prompt 작성 전 vault wiki + D:/claude/content/remotion/public/images/ 최근 5~10 EP BG 1차 리뷰
  • 겹치는 구도 발견 시 다른 장소·다른 소품·다른 조명으로 차별화
  • “거실 소파 + 시계 + 체크리스트” 같은 마무리 구도가 여러 EP에 반복되면 시청자에게 채널 패턴 노출 = 신선도 ↓ (Jake “이전 작업과 구도가 비슷한 건 좀 단점” 지적)

공유용 prompt 단순화 룰 (2026-05-25 papercut 메카 EP 검증)

문제: 영상 댓글·description에 작업용 풀 prompt(50줄 시그니처 디테일)를 그대로 박으면 시청자 진입장벽 ↑. 시청자는 “어디 바꿔야 하지?” 헷갈리고 시도 포기. (Jake 명시 지적: “다른 캐릭터로 사용해보라고 주는 건데 취지에 안 맞음”)

해결: 공유용 prompt = 본문 핵심만 + 교체 자리 1개 명시. 시그니처·비율·디오라마 구성 등 디테일 모두 제거.

공유 prompt 템플릿 (Jake 검증 패턴)

9:16 세로 papercut diorama 일러스트레이션.
주제 = [원하는 캐릭터 혹은 메카닉]
부드러운 페이퍼컷 레이어드 일러스트레이션 스타일.
페이퍼크래프트 디오라마 미학 + 부드러운 둥근 형태 + 따뜻한 톤.
겹친 종이 레이어로 가시적 깊이 + 미묘한 그림자
+ 레이저 컷 카드스톡 가장자리.

[ ] 대괄호 부분만 바꿔서 사용하시면 됩니다.

= 본문 5~6줄 + 교체 자리 1개 + 사용법 1줄. 진입장벽 ↓.


영상 Hook ↔ 공유 prompt 매칭 룰 (2026-05-25)

문제: 영상 hook에서 “한 줄 프롬프트로 만들었어요”라고 단정했는데, 실제 작업 prompt는 시그니처 디테일 50줄 추가본. 시청자가 댓글의 공유 prompt를 따라해도 영상과 다른 결과 = 사기 톤·신뢰 깨짐.

해결: hook 표현과 공유 prompt 형태를 일치시킬 것.

  • hook이 “한 줄”이면 → 공유 prompt도 한 줄에 가까워야 (단순)
  • hook이 “디테일 prompt”면 → 공유 prompt도 풀 본문이어야
  • 작업 단계에서 미리 결정: 한 줄 hook 시리즈 → 톱급 IP로 IP명 한 줄만으로 생성 (시그니처 디테일 X) → Optimus 검증 패턴 차용

작업 단계 룰

  • “한 줄 prompt” hook EP는 작업도 한 줄로 진행 (시그니처 디테일 추가 X)
  • 톱급 글로벌 IP (건담·에반게리온·트랜스포머 등)는 IP명 한 줄로 80% 가능 (Optimus 시안 검증)
  • 마니악 IP는 시그니처 추가 필요 → 그러면 hook도 “디테일 prompt” 톤으로

Why: 2026-05-25 메카 papercut EP에서 hook “한 줄 프롬프트”와 실제 작업 prompt(시그니처 50줄)이 불일치. Jake 명시 지적 “영상에서 소개하는 이미지들은 그렇게 만든 게 아니잖아”. 시청자가 댓글 prompt를 따라도 영상과 다른 결과 = 신뢰 X. hook ↔ 공유 prompt ↔ 작업 prompt 3자 일치성 필수.


🎯 쇼츠 기본 형식 v1 (2026-05-26 확정 — ClaudeNotArchitect20260526 패턴)

Jake가 “특별 요구 없으면 이 형식을 쇼츠 기본”으로 확정. 다음 EP 시작 시 별도 지시 없으면 이 템플릿 적용.

기본 명세

항목기본값
화자예나 (yena_ref.png)
일러스트 톤성숙한 세미리얼 (2026-05-31 갱신) — semi-realistic, mature/natural adult proportions, natural eye size, photoreal skin shading, soft cinematic rendering. ⚠️ highly detailed animation illustration·큰 눈 키워드는 소녀만화(shoujo) 톤 유발 → NOT shoujo/manga, NOT oversized eyes 명시로 제거
컷 수8컷 (Hook + 본문 6 + Outro)
영상 길이35~50s (1.2x 가속 후)
TTSQwen3 예나 + ffmpeg atempo=1.2 + cut08 apad=pad_dur=0.5
BGMAITipsVibes.mp3 재사용 (volume 0.10, 1초 fade-in/out)
자막검정 박스 bottom 650, 흰 텍스트, Pretendard, lineHeight 1.4
컷별 다양화장소·샷 사이즈·시선·자세 매트릭스 (각 컷 다른 환경·각도)
카메라 응시Hook (cut1) + Outro (cut8)만 정면, 본문 6컷은 상황 몰입 (태블릿·화이트보드·카드·옆 가상 동료 응시)
캐릭터 시그니처베이지 자켓 + 흰 셔츠 + 빈 옐로우 ID 카드 (글자 없음/도형) + 긴 갈색 웨이브(half-up) + 앰버브라운 눈 + 골드 주얼리
캐릭터 ref캐릭터 시트 통째로 -i ref (yena_sheet_ref.png) — 단독 컷보다 다각도·표정·복장 정보 풍부해 8컷 1패스 일관성 강함. 단독 컷 추출 불필요 (2026-05-31 검증, Jake 지적)
디바이스화자 쪽 정상 방향 + 정보는 플로팅 UI 카드로 분리
한글letter-by-letter 자모 정확 (Pretendard·Noto Sans KR)
업로드unlisted (일부공개) → Jake 검증 후 공개
Description출처 · 핵심 · 룰 · 인용문 + shorts 태그

다양화 매트릭스 8컷 예시 (Claude-architect EP)

장소·샷시선
1 Hook어두운 사무실 모니터 + alert정면 응시 (advisor hook)
2 도입카페 책상 클로즈업태블릿 몰입
3 문제강의실 화이트보드 옆모습 풀샷화이트보드 향함
4 결과어두운 회의실 와이드 + 빈 의자빈 의자 응시
5 룰 1·2사무실 책상 over-the-shoulder카드 내려봄
6 룰 3·4회의실 둥근 테이블 미디엄 측면옆 가상 동료
7 인용공항 와이드 옆모습 + 가방창밖 사색
8 Outro거실 창가 미디엄 정면정면 응시 (advisor 마무리)

Remotion 컴포지션 패턴

  • src/news/{TopicYYMMDD}.tsx — ClaudeCacheTrap20260430·ClaudeNotArchitect20260526 패턴 차용
  • public/audio/{topic}/ + public/images/{topic}/ 폴더 분리
  • BgmTrack 컴포넌트 + Scene 컴포넌트 (Audio + Img + 자막)
  • PAD_PER_CUT 0.18s, zoomMax 1.06 (Outro 1.03), fadeIn/Out 6프레임

변경 트리거

  • Jake가 명시적으로 “이 EP는 다른 톤으로” / “papercut으로” / “다양화 빼고 정면만” 등 지시 시 일회성 변경
  • 시리즈 누적 학습으로 기본 형식 자체가 v2로 진화하면 이 섹션 갱신

검증 EP

  • D:/claude/content/remotion/src/news/ClaudeNotArchitect20260526.tsx — 원본 템플릿
  • https://youtu.be/84RdiP_hzpc — 첫 발행 (2026-05-26 unlisted)

관련