AIREITER

Veo 4: 확인된 사실과 루머 총정리 (2026년 8월)

마지막 업데이트: 2026-08-13 01:34:12

Google I/O 2026에서는 Veo 4가 나오지 않았다. 공식 Google DeepMind Veo 페이지에 표시된 최신 모델도 2025년 10월 출시된 Veo 3.1이다. 그런데도 여러 서드파티 사이트는 Google 출처를 하나도 제시하지 않은 채 ‘Veo 4’의 4K 출력, 30초 클립, 제로샷 아바타 기능을 내세우고 있다. Veo 4는 Google이 존재를 인정한 제품이 아니며, 애초에 그 이름으로 출시되지 않을 가능성도 있다.

Veo 3.1을 최신 모델로 표시한 Google DeepMind 공식 Veo 페이지

지금 Veo 3.1로 할 수 있는 일

현재 정식 제공 중인 Google의 영상 모델은 Veo 3.1이다. Vertex AI, Gemini 앱, Google Flow에서 사용할 수 있다. DeepMind는 이 모델을 ‘영화 제작자와 스토리텔러의 창작을 지원하도록 설계된’ 모델로 소개하며, 다음 기능을 공식적으로 명시한다.

사양Veo 3.1(확인됨)
해상도720p, 1080p(Standard에서 4K 티어 제공)
클립 길이8초, 연결 가능
네이티브 오디오지원 - 대사, 음향 효과, 주변 소리
이미지 입력첫 프레임 및 마지막 프레임 레퍼런스
제공 환경Vertex AI, Gemini 앱, Google Flow
가격(Standard 1080p + 오디오)초당 $0.40(8초 클립 $3.20)

Google Cloud Vertex AI 가격 페이지에서는 비용을 더 세부적으로 확인할 수 있다. Lite 티어는 영상 전용 720p 기준 초당 $0.03부터 시작하므로, 8초 전체 클립도 $0.25 미만에 생성할 수 있다. 네이티브 오디오를 추가하면 모든 티어에서 초당 비용이 대략 두 배로 올라간다. 비교하면, 오디오 포함 1080p Veo 3.1 Fast는 초당 $0.12, 8초 기준 $0.96으로 Standard 티어의 약 4분의 1 수준이다.

Veo 4가 ‘초당 비용을 낮춘다’는 루머를 평가하려면, 저비용 작업의 기준선이 이미 초당 $0.03부터라는 점을 먼저 봐야 한다.

예측 가능해 보였던 출시 주기가 깨진 이유

2년 동안 Google의 Veo 출시 흐름은 얼핏 규칙적으로 보였다.

  • 2024년 5월(Google I/O): Veo 1 발표
  • 2025년 5월(Google I/O): Veo 3 발표
  • 2025년 10월: 정기 행사와 무관하게 Veo 3.1 출시

연간 발표가 두 번 이어지자 많은 관측자는 2026년 5월 Google I/O에서 Veo 4가 나올 것이라고 예상했다. 하지만 발표는 없었다. 2025년 10월의 Veo 3.1 출시는 I/O 중심 패턴을 이미 깨뜨렸고, Google I/O 2026은 새 모델 번호 대신 전혀 다른 발표인 Gemini Omni를 내놓았다.

2024년부터 2026년까지 Google Veo 모델 출시 흐름과 깨진 연간 패턴을 보여주는 타임라인

연속된 두 번의 연간 발표만으로는 신뢰할 만한 출시 주기를 말할 수 없다. Veo 3.1의 10월 비정기 출시는 Google이 I/O 일정에 묶여 있지 않다는 신호였고, Omni로의 전환은 모델 라인 자체가 재편될 가능성까지 시사한다.

사용자들이 Veo 4에 기대하는 개선점

Veo 3.1을 다룬 Reddit 토론에서는 현 모델의 한계와 맞닿아 있는 요구가 반복적으로 나왔다.

사용자 요구(Reddit)Veo 3.1 현재 상태부족한 점
더 긴 클립(15~30초)한 번 생성 시 최대 8초클립을 수동으로 연결해야 함
더 나은 움직임 물리 표현좋은 편이나 복잡한 동작에는 약함빠른 움직임에서 아티팩트 발생
장면 전환 후에도 일관된 캐릭터보통 수준, 이미지 레퍼런스 필요여러 샷에서 인물 정체성이 흔들림
얼굴·손·피부 묘사 개선전반적으로 강점이나 간헐적 아티팩트 존재클로즈업과 빠른 동작에서 눈에 띔
프롬프트 준수도 향상Veo 3보다 개선됐지만 완벽하지 않음복잡한 프롬프트 일부가 무시됨
멀티카메라 스토리텔링네이티브 지원 없음각 샷을 별도로 생성해야 함

r/VEO3의 ‘Veo 4 Soon I think!’라는 Reddit 스레드는 이런 답답함을 잘 보여준다.

“Veo 3.1은 프로덕션 작업의 속도를 따라가지 못하고 있습니다. 움직임, 인물 렌더링, 이미지-투-비디오 성능에서 확실한 품질 도약이 필요합니다. 경쟁사들은 기다려주지 않습니다.”

경쟁 압박은 실제로 존재한다. Kling 3.0은 1080p 기준 초당 12크레딧으로 네이티브 오디오를 지원하기 시작했으며, 서드파티 분석에 따르면 Seedance 2.5는 30초 클립과 4K 출력을 지원하는 것으로 알려졌다. Google의 Veo 라인은 9개월 넘게 조용한 상태다.

Veo 4 루머, 어디까지 믿어야 할까

pollo.ai, veo40.net, tryveo4.io, aiveo4.ai 등 여러 서드파티 사이트는 Veo 4의 기능으로 비슷한 목록을 제시한다. 거론되는 기능과 현재 확인 가능한 사실을 구분해 보자.

루머로 언급된 기능상태검증 결과
4K 해상도 출력미확인Veo 3.1은 이미 Google Cloud에 4K 가격 티어가 있다. Veo 4 기능이 아니라 현재도 가능한 기능일 수 있다
30초 클립미확인Google 출처 없음. 서드파티 보도에 따르면 Seedance 2.5는 이미 30초 클립을 제공한다
네이티브 스토리보딩미확인인용된 Google 문서에는 단일 API 호출로 여러 장면을 생성한다는 설명이 없다
제로샷 개인화 아바타미확인Google 발표 없음. Omni의 멀티모달 입력 기능과 혼동했을 가능성이 크다
립싱크 및 다국어 오디오 개선미확인Veo 3.1도 이미 네이티브 대사를 생성한다. 개선 가능성은 있으나 문서화된 내용은 아니다
더 낮은 초당 비용미확인Veo 3.1 Lite는 이미 초당 $0.03부터다. 더 낮아지려면 새로운 수준의 효율 개선이 필요하다
고급 다각도 카메라 제어미확인Veo 3.1은 프롬프트로 카메라 연출을 지시할 수 있지만, 전용 제어 시스템의 근거는 없다

이 기능들은 Google 출처 링크 없이 주장되고 있으며, 출시일 역시 인용 근거 없이 추정한 것이다. Pollo AI 기사는 한 페이지 안에서 Veo 3 클립 길이를 ‘약 8초’와 ‘8~15초’로 각각 적어 스스로 모순되기도 한다.

Gemini Omni가 바꾼 Veo 4의 가능성

Google I/O 2026의 가장 중요한 소식은 Veo 4가 아니라 Gemini Omni였다. DeepMind는 이를 ‘무엇으로든 무엇이든 만들 수 있는’ 시스템으로 설명한다. Omni는 Gemini의 추론 계층과 Veo, Nano Banana, Genie를 포함한 Google의 생성형 미디어 스택을 결합한다.

이 발표는 전략적 그림을 바꾼다. Google이 Veo를 독립 모델 라인으로 계속 발전시킬 수도 있지만, 영상 생성을 통합 멀티모달 시스템에 포함할 가능성도 있다. 대화형 영상 편집, 물리 이해, 다중 입력 융합을 앞세운 Omni의 포지셔닝은 후자에 가깝게 보이지만, Google이 이를 확인한 것은 아니다.

Omni가 Google의 핵심 영상 인터페이스가 된다면, 이후 Veo 개선 사항은 독립적인 ‘Veo 4’가 아니라 다른 제품명으로 제공될 수 있다. Google은 Veo 명명 체계를 유지할지 밝히지 않았다. 지금 Veo를 기반으로 작업한다면, 모델명을 하드코딩하지 않고 영상 생성 API를 호출하는 공급자 중립적 파이프라인을 구성하는 것이 현실적인 선택이다. 그러면 Veo 3.1, Kling, 혹은 Omni가 제공하게 될 모델로 전환할 때 다시 작업할 필요가 없다.

기다리지 말고 지금 쓸 수 있는 모델

현재 사용할 수 있는 모델 중 비교할 만한 선택지는 세 가지다.

모델최대 클립 길이해상도네이티브 오디오가격
Veo 3.18초1080p(4K 티어)지원티어별 초당 $0.03~$0.40
Kling 3.010초720p, 1080p, 4K지원(1080p 기준 초당 12크레딧)초당 6~30크레딧, 달러 비용은 플랜별 상이
Seedance 2.5약 30초(보고됨)1080p, 4K지원클립당 약 $0.66~$1.80(추정)

네이티브 오디오가 중요하다면, Vertex AI에서 초당 가격을 투명하게 확인할 수 있는 Veo 3.1이 가장 문서화가 잘 된 선택지다. 한 번에 더 긴 클립을 생성하는 것이 우선이라면 Seedance 2.5의 30초 생성은 Veo 3.1의 8초 제한을 크게 앞선다. Vertex AI 프로젝트를 따로 프로비저닝하지 않아도 Veo 3.1 video generator에서 Veo 3.1을 시험해 볼 수 있다.

Veo 4를 확인할 수 있는 세 가지 신호

아래 중 하나가 나오기 전까지 Veo 4는 제품이 아니라 검색어에 가깝다.

  1. Vertex AI 변경 로그에 새 모델 또는 모델 버전으로 ‘Veo 4’를 명시하는 항목이 올라오는 경우
  2. Google DeepMind 연구 논문의 제목 또는 모델 섹션에서 Veo 4라는 명칭을 사용하는 경우
  3. Google Cloud 제품 페이지에 Veo 4 가격, API 사양 또는 모델 카드가 게시되는 경우

예상했던 I/O 발표 시점으로부터 8개월이 지났는데도 세 가지가 모두 없다는 사실 자체가 의미를 가진다. Google은 Veo 4가 제품명으로 존재하는지, 혹은 영상 기능을 Omni를 통해 제공할지 아직 확인하지 않았다.

FAQ

Veo 4는 공식 출시됐나요?

아니요. 2026년 8월 기준 Google은 Veo 4라는 제품을 발표하거나 출시하거나 존재를 인정한 적이 없습니다. 공식 DeepMind Veo 페이지에는 Veo 3.1이 최신 모델로 표시됩니다. 이 상태를 바꿀 수 있는 기준은 위의 세 가지 확인 신호를 참고하세요.

Veo 4는 언제 출시되나요?

공식 출시일은 없습니다. 매년 Google I/O에서 발표되던 흐름은 2025년 10월 Veo 3.1의 비정기 출시로 깨졌고, I/O 2026의 Gemini Omni 발표로 한층 더 불확실해졌습니다. Google은 언제든 다음 Veo 모델을 출시할 수 있으며, 그 기능을 Omni에 통합할 수도 있습니다.

최신 Google Veo 모델은 무엇인가요?

2025년 10월 출시된 Veo 3.1입니다. 1080p 출력, 연결 가능한 8초 클립, 네이티브 오디오 생성 기능을 지원합니다. 네이티브 오디오는 대사, 음향 효과, 주변 소리를 포함합니다. Vertex AI, Gemini 앱, Google Flow에서 이용할 수 있습니다.

Veo 4를 기다릴까요, 지금 Veo 3.1을 쓸까요?

네이티브 오디오와 Google 생태계 통합이 워크플로에서 가장 중요하다면 지금 Veo 3.1을 쓰는 편이 낫습니다. 출시 일정은 불확실하고 Gemini Omni 전환으로 제품명 자체도 확실하지 않지만, Veo 3.1은 성능과 문서, 가격이 갖춰진 프로덕션용 모델입니다. 긴 클립이 우선이라면 Seedance 2.5와 Kling 3.0이 현재도 10~30초 생성을 제공합니다.

Veo 4는 Gemini 또는 Google Flow에서 사용할 수 있나요?

Google은 Veo 4의 존재나 제공 채널을 확인하지 않았습니다. Veo 3.1은 Gemini 앱과 Google Flow에서 사용할 수 있으며, Veo 기술을 통합하는 Gemini Omni는 I/O 2026에서 Gemini 계층 제품으로 발표됐습니다. 차세대 Veo 기능이 나온다면 이들 환경을 통해 먼저 제공될 가능성이 가장 높습니다.