Видео сразу со звуком
Звук не добавляется отдельной дорожкой позже: модель подбирает его под то, что происходит в кадре. Реплики, шаги, шум улицы и музыка генерируются вместе с картинкой.
Google DeepMind
Звук не добавляется отдельной дорожкой после монтажа: модель подбирает его под то, что происходит в кадре. Реплики, шаги, шум улицы и музыка генерируются вместе с картинкой.






Звук не добавляется отдельной дорожкой позже: модель подбирает его под то, что происходит в кадре. Реплики, шаги, шум улицы и музыка генерируются вместе с картинкой.
Свет, тень и поведение предметов держатся так, как в реальной съёмке: кадр не рассыпается на движении, а предметы падают и движутся по-настоящему.
Версии Fast рассчитаны на объём: ролики под соцсети и рекламные креативы, где важнее скорость и количество вариантов, чем предельное качество кадра.
| Параметр | Veo 3.1 и 3.1 Fast | Veo 3.1 Lite | Veo 3 и 3 Fast |
|---|---|---|---|
| Что принимает на вход | Текст, изображение, видео | Текст, изображение | Текст, изображение |
| Разрешение | 720p, 1080p*, 4K* | 720p, 1080p* | 720p, 1080p |
| Кадров в секунду | 24 | 24 | 24 |
| Длительность ролика | 4, 6, 8 с** | 4, 6, 8 с** | 8 с |
приложение и веб
Veo встроен прямо в ассистента. Описываете ролик словами и получаете готовый файл, без настроек и кода.
съёмочный инструмент
Отдельный инструмент Google Labs под работу со сценами: кадры собираются в последовательность, персонажи и объекты переносятся между ними.
разработчику
Песочница и API: тот же движок вызывается из кода, с выбором версии модели, разрешения и длительности.
Настроить окружение и отправить первый запрос — дело нескольких минут.
import time
from google import genai
from google.genai import types
client = genai.Client()
operation = client.models.generate_videos(
model="veo-3.1-fast-generate-preview",
prompt="медленный наезд на уличную кофейню под дождём, неон отражается в лужах",
config=types.GenerateVideosConfig(
negative_prompt="надписи, вывески, текст в кадре",
aspect_ratio="16:9",
resolution="1080p",
duration_seconds=8,
),
)
while not operation.done:
time.sleep(20)
operation = client.operations.get(operation)
video = operation.response.generated_videos[0]
client.files.download(file=video.video)
video.video.save("cafe_rain.mp4")
Длинную сцену приходится собирать из кусков, и ровно под эту сборку Google сделал отдельный инструмент Flow: кадры выстраиваются в последовательность, а персонажи и предметы переносятся между ними.
Полный список — на странице вопросов.
Veo 3.1. Также работают её быстрый вариант 3.1 Fast и облегчённый 3.1 Lite, а также предыдущее поколение Veo 3 и Veo 3 Fast.
Такого продукта нет. У Google есть Gemini Omni — это мультимодальная модель из другой линейки, и её путают с Veo. Видео отвечает Veo, а Omni относится к Gemini.
До восьми секунд. У Veo 3.1 доступны также 4 и 6 секунд — при разрешении от 1080p либо когда в запрос добавлены референсные изображения.
Да, это главное отличие линейки. Модель подбирает звук под содержимое кадра, а не накладывает его отдельно.
Доступ к нейросети по подписке с оплатой российской картой — без отдельного аккаунта Google.