📄 PDF 내려받기
AI 콘텐츠 자동화 · 9강

영상 생성 자동화

클릭으로 하나씩 만들던 영상을 코드로 시킵니다.
8월 27일 공개된 Gemini Omni 1.1 Flash가 API로 열렸기 때문입니다.

10초
이어붙일 때
참고하는 앞 구간
40초
이어붙여 만들 수 있는
최대 길이
4K
업스케일
가능 해상도
3초
참조로 넣을 수 있는
영상 길이

AI 콘텐츠 자동화 · 9 / 10강 · 출처: Google 개발자 블로그(2026-08-27) · Gemini API 공식 문서

01 · 장면 이어붙이기

10초씩 이어 40초까지

이미 만든 영상에서 끊긴 지점부터 이어서 생성합니다. 이전 모델은 마지막 1초만 참고했지만, Omni 1.1은 직전 10초까지 봅니다. 그래서 장면이 흔들리지 않고 이야기가 이어집니다.

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    previous_interaction_id=previous_video_interaction.id,
    input=[{"type": "text", "text": "Continue the scene."}],
    response_format={"resolution": "360p"},
)

구글 예시 프롬프트: "Continue the video. Execute a cinematic optical dolly-zoom shot." / "The camera pulls back in one continuous movement as he continues his story."

02 · 첫·마지막 프레임

시작과 끝을 정하면
사이를 만들어 줍니다

한 컷의 시작 프레임과 끝 프레임을 지정하면 그 사이를 이어 줍니다. 복잡한 카메라 회전, 줌 전환, 끊김 없이 반복되는 클립에 씁니다.

넣는 것
이미지 두 장
8강에서 만든 이미지가 그대로 첫 프레임이 됩니다. 끝 프레임은 넣어도 되고 안 넣어도 됩니다.
나오는 것
이어지는 한 컷
구글 예시: "One continuous shot, no jump cuts." 끊김 없는 하나의 샷으로 만들어 달라고 적습니다.
03 · 360p 초안

싸게, 빠르게 먼저 봅니다

360p로 만들면 720p보다 최대 60% 빠르고 비용은 3분의 1입니다. 구글이 밝힌 용도는 빠른 시제품, 스토리보드 반복, 개발 중 미리보기입니다.

360p

초안

여러 개 만들어 비교합니다.

720p

기본

지정하지 않으면 이 값입니다.

1080p

고화질

발행용.

4K

업스케일

전문 제작용 출력.

04 · 영상 참조

영상을 넣어 캐릭터를 지킵니다

장면을 만들 때 최대 3초짜리 영상을 참조로 넣을 수 있습니다. 같은 인물·같은 분위기를 여러 장면에 이어 갈 때 씁니다.

구글 예시 프롬프트
"Use the three uploaded videos of dancers and replace them with the provided characters.
Have them perform their individual dances from the reference videos,
all together in the large, open space from the provided image.
The final result should be one continuous shot with no scene cuts."

텍스트·이미지·오디오·영상을 동시에 입력으로 받습니다.

05 · 어디서 쓰나

네 곳에서 열렸습니다

1

Google AI Studio

API 키를 받아 바로 씁니다. 오늘 실습은 여기입니다.

2

Gemini Enterprise Agent Platform API

기업용.

3

Google Flow

AI Plus·Pro·Ultra 구독자에게 오늘부터 전 세계 제공. 8강에서 쓴 그 화면입니다.

4

제미나이 앱

장면 이어붙이기 기능이 제공됩니다.

06 · 코드

이미지를 넣고, 말로 적습니다

from google import genai
client = genai.Client()

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    input=[
        {"type": "image", "data": 첫_프레임, "mime_type": "image/png"},
        {"type": "text",  "text": "카메라가 천천히 밀고 들어간다. 끊김 없는 한 컷."},
    ],
    response_format={"type": "video", "resolution": "360p", "aspect_ratio": "9:16"},
)

with open("scene_01.mp4", "wb") as f:
    f.write(base64.b64decode(interaction.output_video.data))

준비물은 두 줄입니다 — pip install google-genai 그리고 export GEMINI_API_KEY="내 키"

07 · 가격

얼마인지 알고 시작합니다

결제 수단이 등록된 API 키가 필요합니다(구글 클라우드 콘솔 → 결제). 예전 강의에 나오는 「가입 시 300달러 무료 크레딧」은 지금은 없습니다. 실제로 비용이 나갑니다.

공식 기준입니다. 영상 출력 토큰으로 계산하며, Omni는 한 번에 10초를 만들고, 720p 1초 = 5,792토큰, 토큰 100만 개당 $17.501초에 약 $0.10입니다. 무료 사용량은 없습니다.

만드는 것360p (1/3)720p
장면 1개 (10초)약 470원약 1,400원
3장면 (30초)약 1,400원약 4,200원
쇼츠 1편 (10장면 · 100초)약 4,700원약 14,000원

그래서 360p로 전체를 먼저 만들고, 고른 장면만 720p로 다시 뽑습니다. 1만 4천 원이 4천 7백 원이 됩니다.

돈을 쓰는 방식
지금 단계에서 전부를 자동화할 필요는 없습니다. 콘텐츠를 직접 만들어 보면서, 나중에 자동화할 부분에만 조금씩 투자하는 편이 좋습니다.

그래서 우리는 영상 생성만 이 모델에 맡깁니다. 분석·기획·나레이션은 로컬 AI로 0원, 영상도 가장 저렴한 Omni로 — 자동화하면서 드는 돈을 최소로 만듭니다.
08 · 알아둘 것

공식 문서가 짚은 제한

01

업로드 영상은 10초 이하

단, 모델이 만든 영상을 이어붙일 때는 예외입니다.

02

이어붙이기는 40초까지

10초 단위로 누적해서 최대 40초.

03

무료 사용량 없음

결제 수단이 등록된 키가 필요합니다.

04

지역 제한

유럽경제지역·스위스·영국에서는 미성년자가 담긴 이미지 업로드·편집이 지원되지 않습니다.

09 · 강의 노트 ①

코랩에서 한 여덟 걸음

실습 영상에서 순서대로 누른 것만 적었습니다. 옆에 두고 따라 하시면 됩니다.

1

도구 설치

google-genai2.0 이상으로 설치합니다. 버전이 2보다 낮으면 Omni가 열리지 않습니다.

2

API 키 연결

구글 AI 스튜디오 왼쪽 아래 API 키에서 복사해 넣고 재생을 누릅니다.

3

무엇을 만들지 적기

스타일 · 소리 규칙 · 장면별 이미지 프롬프트와 영상 프롬프트를 적습니다. 8강 기획기가 내준 것을 그대로 옮기면 됩니다.

4

얼마 드는지 먼저 봅니다

장면 수와 화질을 넣으면 금액이 나옵니다. 10초 두 장면을 360p로 만들면 약 933원입니다.

5

첫 그림 만들기

나노바나나 프로가 장면마다 첫 프레임을 만듭니다. 비율은 코드에서 정합니다.

6

그림을 움직이기

그 그림을 첫 장면으로 Omni 1.1 Flash가 영상을 만듭니다. 다음 장면은 앞 장면을 이어받습니다.

7

확인하고 내려받기

이어붙인 마지막 파일이 전체 영상입니다. 캡컷에 넣으면 됩니다.

8

쓴 돈을 확인합니다

구글 AI 스튜디오의 Spend 화면에서 지금까지 나간 API 비용을 볼 수 있습니다. 만들 때마다 확인하는 습관을 들입니다.

노트북은 「파일 → .ipynb 다운로드」로 받아 콘텐츠 자동화 프로젝트 폴더에 넣어 둡니다.

10 · 강의 노트 ②

도구에 세 번째 파트를 붙입니다

1·2편에서 만든 도구는 분석과 기획까지 했습니다. 여기에 제작을 붙여 한 번의 클릭으로 영상이 나오게 합니다. 안티그래비티에 아래 그대로 적었습니다.

프로젝트 전체 분석

세 번째 파트 추가 개발

1. 첫 번째 파트에서 영상 분석 후, 두 번째 파트에서 이미지 프롬프트 ·
   영상 생성 프롬프트 · 오디오 생성된 것을 기반으로
2. 이미지 생성과 영상 생성을 다음의 코드를 기반으로 생성
3. 세 번째 파트를 추가 개발하여 생성된 영상과 오디오를
   하나의 영상으로 합성 및 자동화

참고 코드 : (코랩에서 받은 자동화 코드를 여기에 그대로 붙여 넣습니다)

API 키 필요시 .env 파일로 저장
01

참고 코드를 함께 줍니다

코드를 주면 에이전트가 헤매지 않습니다. 토큰도 아끼고 결과도 정확해집니다.

02

키는 .env에 넣습니다

코드에 그대로 쓰면 밖으로 노출됩니다. .env는 내보내지 않는 파일입니다.

03

오디오는 그대로 씁니다

7강에서 무료로 만든 나레이션을 씁니다. 돈 드는 것은 이미지와 영상뿐입니다.

04

ffmpeg가 합칩니다

영상과 오디오를 하나로 붙여 final.mp4를 만듭니다.

11 · 직접 해보기

만들어진 것을 고쳐 봅니다

강의에서 나온 첫 결과에도 어긋난 곳이 셋 있었습니다. 그대로 두지 마시고 고쳐 보십시오. 고치는 훈련이 실력이 됩니다.

어긋난 곳안티그래비티에 이렇게 말합니다
가로로 기획했는데 세로로 나옵니다이미지를 생성했는데 가로로 안 되는 것 같아. 기획서의 비율을 따라가게 고쳐 줘
효과음이 사라졌습니다영상을 합성할 때 생성된 효과음을 없애지 말고 포함시켜 줘
나레이션이 어색합니다기획에서 생성된 나레이션으로 이 영상에 넣어 줘
원칙
전부 자동화하지 않습니다

원리만 알아 두고, 지금은 콘텐츠를 직접 만들며 실력을 쌓습니다. 자동화는 그다음입니다.

이유
API를 쓰는 순간
사업이 됩니다

영상 하나에 얼마가 드는지 매번 계산하는 습관을 먼저 만듭니다. 무턱대고 투자하지 않습니다.

AI CITY BUILDERS · 9강 교재 · 출처: Google 개발자 블로그(2026-08-27), Gemini API 공식 문서·가격표, 9강 강의

1 / 9