Thumbnail

한 줄 요약

175분 Google I/O 2026 keynote 중 Demis Hassabis의 Gemini Omni 발표 4분을 한국어 큐레이션 99초로. Veo + 나노 바나나 + Genie가 단일 모델로 통합, “Anything → Anything” 패러다임. 5월 19일 Omni Flash 즉시 출시. 클로드+제이크 듀오 보이스, 정보 슬라이드 보드 + 영상 정지 프레임 BG + 캐릭터 PIP. 장편 큐레이션 트랙 시리즈 첫 EP.

핵심

항목
트랙신규 — 장편 큐레이션 (가로 16:9, 시리즈 EP와 별도)
원본 출처Google I/O 2026 라이브 keynote · 175분 · video_id wYSncx9zLIU
큐레이션 구간Demis Hassabis Omni 발표 (transcript 4901-5135s, 4분) → 99초
영상 offsettranscript - 3897s = 영상 위치 (라이브 첫 64분 잘림 검증)
화면 비율1280×720 (16:9) 30fps
컷 구성영상 4 + AI 정보 컷 2 + 캐릭터 컷 6 = 12
캐릭터클로드(분석) + 제이크(감상) 듀오 / 컷 안 표정 변화 2개 (ffmpeg overlay timing)
보드 디자인흰 라운드 카드 + 빨간 번호 배지 + 컬러 항목 카드 + 분홍 INSIGHT 박스
보이스Supertone Eddie 1.20x atempo (클로드) · Leo 1.15x atempo (제이크) — speed=1.0 + 후처리
썸네일Codex CLI gpt-image-2 -i duo_ref.png 캐릭터 ref 전달 + Jake 정본 마무리(TUESDAY MAY 19)
Fair Use영상 클립 비중 22초/99초 (≈22%) · 캐릭터·AI 보드로 화면 덮음 · Disclaimer + 원본 링크

발표 핵심 (영상 정리)

  1. Gemini Omni 공개 — 데미스 하사비스 직접 발표 (2026-05-19 화요일)
  2. Anything → Anything — 모든 입력에서 모든 출력. Veo(영상) + 나노 바나나(이미지) + Genie(시뮬레이션)가 단일 모델로 통합
  3. 물리법칙 step-change — 운동에너지·중력 시뮬레이션 정확도 한 단계 진화 (이전 모델은 “intuitive physics” 수준)
  4. Claymation 데모 — “단백질 접힘 클레이메이션 설명 영상” 프롬프트 한 줄 → 알파헬릭스·베타시트 정확한 과학 다큐
  5. 대화로 영상 편집 — 셀카 영상 + 디테일/스타일/요소 조정 = 장면 전체가 새 아이디어에 맞춰 변형
  6. Omni Flash 5/19 출시 — Gemini 앱 · Google Flow · YouTube Shorts. APIs 곧
  7. Omni Pro 곧 — Pro 모델은 곧 출시 예정

후기

장편 큐레이션 트랙(가로 16:9)의 시리즈 첫 EP. GPT Image 2 쇼츠 시리즈와 별개 라인 — Jake 첨부 가이드(video-summary-narration-pipeline) 기반으로 환경·파이프라인 셋업부터 풀사이클.

  • 🚨 학습 1 — yt-dlp 봇 차단 우회: cookies-from-browser 셋 다 실패 (chrome DB락 · edge DPAPI · firefox 미설치) → youtube-transcript-api 채택. CC 활성 영상이면 충분.
  • 🚨 학습 2 — 영상 offset 검증: Jake 받은 영상이 라이브 첫 64분 잘림. transcript 4914s “world model” 발화 = 영상 1017s에서 검증. offset 정확히 3897s.
  • 🚨 학습 3 — Supertone duration 압축: est_dur(text) = n*0.10+1.5 추정이 짧아 끝부분 누락 (cut06 “이런 영상이 나옵니다” 안 들림). 보정 = n*0.17 + 2.0.
  • 🚨 학습 4 — speed 직접 적용 시 음질 깨짐: Supertone payload speed=1.2 직접 → atempo 안 한 채 자체 압축 → 깨짐. 룰 = speed=1.0 + ffmpeg atempo 후처리.
  • 🚨 학습 5 — PAD 0.8s 무음 = 끊긴 느낌: 컷 사이 PAD_LEAD+TAIL=0.80s가 “대사 끊김”으로 인식. 0.30s로 축소 + BGM은 다음 EP에서.
  • 🚨 학습 6 — codex -i FILE... 함수 흡수: -i ref.png "prompt" 직접 시 prompt를 추가 image로 흡수. -- separator 필수: codex exec ... -i ref.png -- "$(cat prompt.txt)".
  • 🚨 학습 7 — codex가 PIL fallback : “text accuracy”를 이유로 image_generation 도구 안 쓰고 PIL로 그림. prompt에 명시: “반드시 image_generation 도구 사용, PIL fallback 금지”.
  • 🚨 학습 8 — 시간 표현 절대화: “오늘 출시” 같은 상대 표현은 발행 후 즉시 stale. 절대 날짜(“5/19”, “TUESDAY MAY 19”)로.

자산 위치

  • 영상: D:\claude\content\reclip\highlights3p3\highlight_v3p3_final.mp4
  • 썸네일: D:\claude\content\reclip\highlights3p3\thumbnail.png (Jake 정본)
  • Job 폴더: D:\claude\content\reclip\jobs\io26-omni-v1\
    • plan.json — 12컷 PLAN
    • build_*.py — TTS/보드/캐릭터/clip 빌드 스크립트
    • tts_v2/ — Supertone mp3 (raw + atempo)
    • boards_v3p3/ — 정보 보드 8장
    • char_resized/ — 표정 PNG (clo · jake 5 expr 각)
    • bg_frames/ — 영상 정지 프레임 5장
    • clips_final_v3p3/ — 컷별 mp4 12개
  • 업로드: D:\claude\content\youtube-upload\_upload_io26_omni.py

관련

Fair Use Disclaimer (description에 박힘)

본 영상은 Google I/O 2026 Keynote의 일부를 공정 이용(Fair Use) 가이드라인에 따라 인용하였으며, AI 생성 이미지와 자체 분석·논평을 결합한 변형적 콘텐츠입니다. 원본 영상: https://www.youtube.com/live/wYSncx9zLIU