클릭으로 하나씩 만들던 영상을 코드로 시킵니다.
8월 27일 공개된 Gemini Omni 1.1 Flash가 API로 열렸기 때문입니다.
AI 콘텐츠 자동화 · 9 / 10강 · 출처: Google 개발자 블로그(2026-08-27) · Gemini API 공식 문서
이미 만든 영상에서 끊긴 지점부터 이어서 생성합니다. 이전 모델은 마지막 1초만 참고했지만, Omni 1.1은 직전 10초까지 봅니다. 그래서 장면이 흔들리지 않고 이야기가 이어집니다.
interaction = client.interactions.create(
model="gemini-omni-1.1-flash",
previous_interaction_id=previous_video_interaction.id,
input=[{"type": "text", "text": "Continue the scene."}],
response_format={"resolution": "360p"},
)
구글 예시 프롬프트: "Continue the video. Execute a cinematic optical dolly-zoom shot." / "The camera pulls back in one continuous movement as he continues his story."
한 컷의 시작 프레임과 끝 프레임을 지정하면 그 사이를 이어 줍니다. 복잡한 카메라 회전, 줌 전환, 끊김 없이 반복되는 클립에 씁니다.
360p로 만들면 720p보다 최대 60% 빠르고 비용은 3분의 1입니다. 구글이 밝힌 용도는 빠른 시제품, 스토리보드 반복, 개발 중 미리보기입니다.
여러 개 만들어 비교합니다.
지정하지 않으면 이 값입니다.
발행용.
전문 제작용 출력.
장면을 만들 때 최대 3초짜리 영상을 참조로 넣을 수 있습니다. 같은 인물·같은 분위기를 여러 장면에 이어 갈 때 씁니다.
구글 예시 프롬프트 "Use the three uploaded videos of dancers and replace them with the provided characters. Have them perform their individual dances from the reference videos, all together in the large, open space from the provided image. The final result should be one continuous shot with no scene cuts."
텍스트·이미지·오디오·영상을 동시에 입력으로 받습니다.
API 키를 받아 바로 씁니다. 오늘 실습은 여기입니다.
기업용.
AI Plus·Pro·Ultra 구독자에게 오늘부터 전 세계 제공. 8강에서 쓴 그 화면입니다.
장면 이어붙이기 기능이 제공됩니다.
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-omni-1.1-flash",
input=[
{"type": "image", "data": 첫_프레임, "mime_type": "image/png"},
{"type": "text", "text": "카메라가 천천히 밀고 들어간다. 끊김 없는 한 컷."},
],
response_format={"type": "video", "resolution": "360p", "aspect_ratio": "9:16"},
)
with open("scene_01.mp4", "wb") as f:
f.write(base64.b64decode(interaction.output_video.data))
준비물은 두 줄입니다 — pip install google-genai 그리고 export GEMINI_API_KEY="내 키"
결제 수단이 등록된 API 키가 필요합니다(구글 클라우드 콘솔 → 결제). 예전 강의에 나오는 「가입 시 300달러 무료 크레딧」은 지금은 없습니다. 실제로 비용이 나갑니다.
공식 기준입니다. 영상 출력 토큰으로 계산하며, Omni는 한 번에 10초를 만들고, 720p 1초 = 5,792토큰, 토큰 100만 개당 $17.50 — 1초에 약 $0.10입니다. 무료 사용량은 없습니다.
| 만드는 것 | 360p (1/3) | 720p |
|---|---|---|
| 장면 1개 (10초) | 약 470원 | 약 1,400원 |
| 3장면 (30초) | 약 1,400원 | 약 4,200원 |
| 쇼츠 1편 (10장면 · 100초) | 약 4,700원 | 약 14,000원 |
그래서 360p로 전체를 먼저 만들고, 고른 장면만 720p로 다시 뽑습니다. 1만 4천 원이 4천 7백 원이 됩니다.
단, 모델이 만든 영상을 이어붙일 때는 예외입니다.
10초 단위로 누적해서 최대 40초.
결제 수단이 등록된 키가 필요합니다.
유럽경제지역·스위스·영국에서는 미성년자가 담긴 이미지 업로드·편집이 지원되지 않습니다.
실습 영상에서 순서대로 누른 것만 적었습니다. 옆에 두고 따라 하시면 됩니다.
google-genai를 2.0 이상으로 설치합니다. 버전이 2보다 낮으면 Omni가 열리지 않습니다.
구글 AI 스튜디오 왼쪽 아래 API 키에서 복사해 넣고 재생을 누릅니다.
스타일 · 소리 규칙 · 장면별 이미지 프롬프트와 영상 프롬프트를 적습니다. 8강 기획기가 내준 것을 그대로 옮기면 됩니다.
장면 수와 화질을 넣으면 금액이 나옵니다. 10초 두 장면을 360p로 만들면 약 933원입니다.
나노바나나 프로가 장면마다 첫 프레임을 만듭니다. 비율은 코드에서 정합니다.
그 그림을 첫 장면으로 Omni 1.1 Flash가 영상을 만듭니다. 다음 장면은 앞 장면을 이어받습니다.
이어붙인 마지막 파일이 전체 영상입니다. 캡컷에 넣으면 됩니다.
구글 AI 스튜디오의 Spend 화면에서 지금까지 나간 API 비용을 볼 수 있습니다. 만들 때마다 확인하는 습관을 들입니다.
노트북은 「파일 → .ipynb 다운로드」로 받아 콘텐츠 자동화 프로젝트 폴더에 넣어 둡니다.
1·2편에서 만든 도구는 분석과 기획까지 했습니다. 여기에 제작을 붙여 한 번의 클릭으로 영상이 나오게 합니다. 안티그래비티에 아래 그대로 적었습니다.
프로젝트 전체 분석 세 번째 파트 추가 개발 1. 첫 번째 파트에서 영상 분석 후, 두 번째 파트에서 이미지 프롬프트 · 영상 생성 프롬프트 · 오디오 생성된 것을 기반으로 2. 이미지 생성과 영상 생성을 다음의 코드를 기반으로 생성 3. 세 번째 파트를 추가 개발하여 생성된 영상과 오디오를 하나의 영상으로 합성 및 자동화 참고 코드 : (코랩에서 받은 자동화 코드를 여기에 그대로 붙여 넣습니다) API 키 필요시 .env 파일로 저장
코드를 주면 에이전트가 헤매지 않습니다. 토큰도 아끼고 결과도 정확해집니다.
코드에 그대로 쓰면 밖으로 노출됩니다. .env는 내보내지 않는 파일입니다.
7강에서 무료로 만든 나레이션을 씁니다. 돈 드는 것은 이미지와 영상뿐입니다.
영상과 오디오를 하나로 붙여 final.mp4를 만듭니다.
강의에서 나온 첫 결과에도 어긋난 곳이 셋 있었습니다. 그대로 두지 마시고 고쳐 보십시오. 고치는 훈련이 실력이 됩니다.
| 어긋난 곳 | 안티그래비티에 이렇게 말합니다 |
|---|---|
| 가로로 기획했는데 세로로 나옵니다 | 이미지를 생성했는데 가로로 안 되는 것 같아. 기획서의 비율을 따라가게 고쳐 줘 |
| 효과음이 사라졌습니다 | 영상을 합성할 때 생성된 효과음을 없애지 말고 포함시켜 줘 |
| 나레이션이 어색합니다 | 기획에서 생성된 나레이션으로 이 영상에 넣어 줘 |
원리만 알아 두고, 지금은 콘텐츠를 직접 만들며 실력을 쌓습니다. 자동화는 그다음입니다.
영상 하나에 얼마가 드는지 매번 계산하는 습관을 먼저 만듭니다. 무턱대고 투자하지 않습니다.
AI CITY BUILDERS · 9강 교재 · 출처: Google 개발자 블로그(2026-08-27), Gemini API 공식 문서·가격표, 9강 강의