Google Veo: что умеет видеогенератор со звуком, сколько стоит и как обстоит дело с доступом из России

Главное отличие Veo от остальных видеогенераторов заметно с первой секунды ролика: он сразу выдаёт звук — реплики персонажей, шаги, шум улицы и музыку, попадающие в такт картинке.

Разбираем линейку Veo 2, 3 и 3.1, что модель умеет сейчас — от восьмисекундных сцен до 4K и устойчивых персонажей, четыре разных входа к ней, тарифы Google в рублях, честную картину с доступом из России с проверкой на 25 августа, чем её заменяют без VPN, структуру промпта для видео и готовый ассистент, который собирает раскадровку.

Google Veo: что умеет видеогенератор со звуком, сколько стоит и как обстоит дело с доступом из России
Дмитрий Борейчук
Автор
Дмитрий Борейчук
• 11+ лет опыта в маркетинге и продажах • Опыт более 1000 проектов  • Основатель онлайн школы по ИИ для заработка и бизнеса
Страница автора
💡 Хотите прокачаться в ИИ и маркетинге?
Подпишитесь на Telegram-канал Дмитрия. Получите выжимку 11 лет опыта в суровом маркетинге и плоды 2 лет 24/7 работы с ИИ
Перейти в Telegram-канал

Veo — видеогенератор Google, и его главное отличие от остальных заметно с первой секунды
ролика: он сразу выдаёт звук. Не немую картинку, к которой потом подбирают музыку,
а сцену с репликами персонажей, шагами, шумом улицы и фоновой музыкой.

Дальше начинается неприятная часть для российского зрителя: официально Veo сюда не пускают,
и дело не только в адресе подключения. Ниже — что модель умеет в текущей версии, сколько
стоит, как обстоит дело с доступом из России на 25 августа 2026 года и чем её заменяют
те, кто не хочет возиться с VPN.


Что такое Veo и чем он отличается

Veo — семейство моделей для генерации видео от Google DeepMind. Вы описываете сцену
текстом или прикладываете картинку, модель возвращает ролик.

Отличие, которое изменило рынок в 2025 году: начиная с третьей версии Veo генерирует
звук вместе с картинкой. До этого все видеогенераторы выдавали немой ролик, и звук
приходилось собирать отдельно — озвучка, шумы, музыка, синхронизация. Здесь диалоги
персонажей, окружающие звуки и музыка появляются сразу и попадают в такт изображению.

Второе отличие — сила в физике и связности сцены. Движение предметов, походка, вода,
ткань выглядят достовернее, чем у большинства конкурентов, а объекты не «переливаются»
между кадрами.

Третье — интеграция с остальным набором Google. Модель живёт не отдельным сайтом,
а внутри Gemini, инструмента Flow для монтажа сцен и облачных сервисов для разработчиков.


Версии: Veo 2, Veo 3 и Veo 3.1

ВерсияЧто принесла
Veo 2базовая генерация видео по тексту и картинке, без звука
Veo 3нативный звук: диалоги, шумы, музыка вместе с картинкой
Veo 3.1вертикальный формат 9:16, апскейл до 4K, устойчивые персонажи между сценами

Обновление января 2026 года добавило то, чего не хватало для соцсетей: вертикаль под
короткие видео и режим, в котором один и тот же персонаж сохраняет внешность в разных
сценах. Для рекламных серий и мультиков это решающая вещь — до этого герой менялся
от ролика к ролику.

В интерфейсах чаще всего доступны две линии: обычная и облегчённая. Облегчённая считает
быстрее и дешевле, обычная даёт лучшее качество и полный набор возможностей.


Российский сервис, без VPN
Сделайте сайт и ИИ-агента в одном окне — за вечер, а не за месяц
  • Сайт собирается диалогом: описали идею — смотрите, как он рождается
  • ИИ-сотрудник отвечает клиентам в Telegram, WhatsApp, Avito и на сайте
  • Без VPN и иностранных карт — оплата в рублях
Попробовать Ною
7 дней бесплатного пробного периода — платить не обязательно

Что модель умеет сейчас

ВозможностьКак устроено
Видео по текстуописание сцены → готовый ролик со звуком
Видео по картинкезагруженный кадр становится первым кадром сцены
Первый и последний кадрзадаёте начало и конец, модель достраивает движение между ними
Длительность одной сценыоколо восьми секунд
Длинные роликисцены собираются в последовательность во Flow, до пары минут
Разрешениедо 4K с апскейлом
Форматыгоризонтальный и вертикальный 9:16
Постоянные персонажирежим, где герой сохраняет внешность между сценами

Восемь секунд на сцену — не ограничение конкретно Veo, а общее свойство нынешних
видеомоделей: дальше связность распадается. Поэтому длинные ролики везде собираются
из коротких сцен, и работа с монтажом становится частью процесса.


Где им пользуются: четыре разных входа

ВходКому подходит
Geminiбыстро сделать ролик в разговоре с моделью
Flowсобрать сцену за сценой, задать кадры, перебрать варианты
Gemini APIвстроить генерацию в свой сервис
Vertex AIкорпоративный контур с расширенными настройками

Flow здесь ключевой инструмент: это не просто окно генерации, а среда, где ролик
собирается из сцен, задаются опорные кадры и хранятся варианты. Именно в нём получаются
осмысленные ролики, а не отдельные восьмисекундные отрывки.


Сколько это стоит

Отдельной подписки на Veo нет — доступ идёт через общие тарифы Google на ИИ.

ТарифЦена в месяцЧто даёт
Бесплатный уровень0ограниченное число генераций, обычно на облегчённой модели
Google AI Pro$19.99 (≈1 670 ₽)регулярная генерация, доступ к Flow
Google AI Ultra$49.99 (≈4 160 ₽)максимальные лимиты, лучшее качество, 4K
По APIоплата за секунду видеодля встраивания в свой продукт

Рубли пересчитаны по курсу Центробанка на 25 августа 2026 года — 83,29 ₽ за доллар.
Отдельно стоит учитывать расход попыток: на один пригодный ролик уходит от трёх
до десяти генераций, и лимиты тарифа кончаются быстрее, чем ожидаешь.


Доступ из России

Здесь всё честно и неприятно.

Сайт Gemini из России открывается, но это ничего не значит: Google смотрит не только
на адрес подключения, но и на страну аккаунта. Инструмент Flow, через который и делают
нормальные ролики, с российского адреса сразу уводит на страницу «регион не поддерживается» —
проверено 25 августа 2026 года: из Германии тот же адрес открывается штатно.

Что это означает на практике:

  • VPN нужен постоянно, а не только на регистрацию;
  • аккаунт должен быть с другой страной — российского региона в профиле достаточно
для отказа даже под VPN;
  • оплата российской картой не пройдёт: нужна карта иностранного банка или посредник;
  • бесплатный уровень тоже закрыт — он привязан к тому же аккаунту.

Итог: Veo из России доступен, но через несколько ухищрений сразу, и это осознанный выбор
ради конкретного результата — сцен со звуком, которых больше почти никто не даёт.


Чем заменить: что работает без VPN

СервисЧем силёнДоступ
Klingсильная физика движения, длинные сценыоткрывается, оплата картой затруднена
Doitongроссийский интерфейс и оплата рублямибез VPN
Hailuoбыстрые ролики, щедрый бесплатный режимоткрывается
Kandinsky Videoрусский промпт, бесплатнобез VPN
Шедеврумкороткие ролики в приложении Яндексабез VPN

Подробное сравнение российских и зарубежных видеогенераторов, включая то, что осталось
после закрытия Sora, разобрано отдельно:
нейросеть для создания видео и
чем заменить Sora.

Практический вывод: если задача — поток коротких роликов для соцсетей на русском,
российские сервисы закрывают её без VPN и карт. Veo берут тогда, когда нужен звук
в кадре и достоверная физика — например, для рекламного ролика, где видно каждую деталь.


Как собрать ролик из сцен: рабочий процесс

Готовое видео почти никогда не выходит одной генерацией. Порядок, который экономит время
и деньги, выглядит так.

ШагЧто делаетеЗачем
1. Сценарийдесять строк текста: что происходит и чем заканчиваетсябез него сцены не складываются в историю
2. Раскадровкаразбивка на сцены по восемь секундвидно, сколько генераций понадобится
3. Опорные кадрыпервый и последний кадр важных сценмодель достраивает движение между ними
4. Генерацияпо три-четыре варианта на сценувыбирать не из чего, если делать по одному
5. Отборпо связности движения, а не по красотекрасивый, но рваный кадр в монтаже не спасти
6. Монтаж и звуксклейка, подгонка звука, субтитрытекст на экране добавляется здесь

Пятый шаг чаще всего делают неправильно. Отбирают кадр, который понравился сам по себе,
а потом он не стыкуется с соседними: движение идёт в другую сторону, свет меняется,
персонаж выглядит иначе. Смотреть надо сразу парами: как эта сцена встанет рядом
с предыдущей.


Сколько стоит минута готового видео

Считать удобнее не в генерациях, а в минутах итогового ролика.

Минута видео — это примерно восемь сцен по восемь секунд. На каждую сцену уходит
от трёх до пяти генераций, пока не получится пригодный вариант. Итого на минуту готового
ролика — порядка тридцати генераций.

Что считаемОриентир
Сцен в минуте готового видеооколо восьми
Генераций на одну пригодную сцену3–5
Генераций на минуту ролика25–40
Время на минуту с монтажомот двух до четырёх часов на первом ролике
Дальше по отработанному шаблону40–60 минут

Отсюда практический вывод: лимиты тарифа надо считать по попыткам, а не по числу нужных
роликов. Тариф, рассчитанный «одна генерация — одна сцена», кончается на середине первого
же проекта.


Что Veo пока не умеет

Честный список ограничений, общих почти для всех видеомоделей.

ОграничениеЧто происходитКак обойти
Длинные диалогигубы рассинхронизируются, интонации плывутреплики до пары фраз, остальное — закадровым голосом
Точный текст на экраненадписи выходят неровнотитры и цены добавлять при монтаже
Руки и мелкая моторикапальцы и работа с мелкими предметами выдают генерациюсредний и общий план вместо крупного
Узнаваемые люди и брендыгенерация ограничена правилами сервисаиспользовать собирательные образы
Длительность сценывосемь секунд, промптом не обходитсясобирать длинное монтажом из сцен

Права, водяные знаки и реклама

Вопрос, который всплывает, когда ролик уже готов и его пора публиковать.

Все видео, сгенерированные моделями Google, помечаются технологией SynthID: невидимый
глазу маркер встраивается прямо в пиксели кадров и переживает сжатие, обрезку и цветокоррекцию.
Это не водяной знак поверх картинки, а способ подтвердить, что видео сгенерировано.

Коммерческое использование результата на платных тарифах разрешено, но условия отличаются
по типу подписки, и перед серьёзным проектом их стоит перечитать в актуальной редакции:
у корпоративных и премиальных планов права шире, чем у базовых.

Отдельно про российские требования: маркировка рекламы и правила о персональных данных
работают независимо от того, снят ролик камерой или сгенерирован. Если в кадре узнаваемый
человек — нужно согласие; если ролик рекламный — нужна маркировка.


Для каких задач это реально применимо

ЗадачаНасколько подходит
Короткие ролики для соцсетейхорошо: восемь секунд — родной формат
Рекламная заставка и имиджевый роликхорошо, если сцены простые и их немного
Демонстрация товара в действиисредне: мелкие детали и руки выдают генерацию
Обучающее видео с говорящей головойплохо: длинные реплики рассинхронизируются
Мультипликация и сказкихорошо: условность стиля скрывает слабые места
Съёмка вашего реального объектане подходит: модель не знает ваш цех и товар

Общее правило то же, что и с картинками: генерация выигрывает там, где нужна атмосфера
и условность, и проигрывает там, где нужна документальная точность и конкретика вашего
бизнеса.


Как писать промпт для видео

Промпт для видео отличается от промпта для картинки одним: кроме кадра нужно описать,
что происходит за эти секунды и как движется камера.

Рабочая структура выглядит так:

  1. Кто или что в кадре — герой, предмет, сцена.
  2. Что происходит — действие целиком, без резких смен: восемь секунд не вмещают
две сцены.
  1. Как движется камера — статичный кадр, наезд, отъезд, проезд сбоку, съёмка с руки.
  2. Свет и время суток — тот же словарь, что и для фотографии.
  3. Стиль — документальная съёмка, кинокадр, мультипликация, 3D-рендер.
  4. Звук — реплики персонажей в кавычках, окружающие шумы, характер музыки.
  5. Формат — горизонтальный или вертикальный кадр.

Пример собранного промпта:

Промпт
Пожилой мастер в автосервисе поднимает капот и заглядывает внутрь,
медленный наезд камеры на его лицо, утренний свет из открытых ворот,
документальная съёмка, зерно плёнки, звук: щелчок замка капота,
далёкий шум мастерской, реплика: «Ну, посмотрим, что тут у нас»,
вертикальный кадр 9:16

Разбор промптов для статичных изображений — со словарями света, ракурсов и оптики —
в отдельном материале:
нейросеть для генерации изображений.


Готовый промпт-ассистент

Скопируйте в любую чат-модель — ГигаЧат, Алису, ChatGPT — и отвечайте своими словами.
На выходе получите готовый промпт для видеогенератора и раскадровку из нескольких сцен.

Промпт
Ты — режиссёр коротких роликов, который последние три года переводит
сценарии на язык видеогенераторов. Ты знаешь, что одна сцена длится
около восьми секунд, что за это время нельзя показать две разные ситуации
и что звук описывается отдельно от картинки.

ЗАДАЧА
Собрать для меня промпт под видеогенератор и раскадровку ролика.

ПОРЯДОК РАБОТЫ

1. Спроси, для чего ролик и где он будет опубликован: [моя задача и площадка].
2. Спроси, что должно произойти в кадре и кто в нём: [что в кадре].
3. Спроси, какое действие должен совершить зритель после просмотра:
   [действие зрителя].
4. Спроси про ограничения: фирменные цвета, чего быть не должно,
   нужен ли текст на экране: [мои ограничения].
5. Спроси, в каком генераторе я буду запускать и есть ли у него звук:
   [мой генератор].
6. Разбей замысел на сцены по восемь секунд и покажи раскадровку:
   номер сцены, что происходит, движение камеры, звук.
7. Для каждой сцены собери промпт по структуре: кто и что в кадре, действие,
   движение камеры, свет, стиль, звук, формат.
8. Предложи три варианта первой сцены с разными зацепками для зрителя
   и объясни, чем они отличаются.
9. Назови, что проверить в готовом ролике: связность движения, лица и руки,
   попадание звука в картинку.

ФОРМАТ ОТВЕТА
Сначала раскадровка таблицей: сцена, что происходит, камера, звук, длительность.
Затем промпты по сценам отдельными блоками, готовые к копированию. Затем три
варианта первой сцены. В конце — список проверок для готового ролика.

ПРАВИЛА
Не вмещай две ситуации в одну сцену: это главная причина, по которой ролик
разваливается. Не используй отрицания в описании кадра — описывай то, что есть.
Реплики персонажей давай в кавычках и короткими, до семи слов. Если генератор
без звука, скажи об этом и предложи, чем озвучивать отдельно. Чего не хватает —
помечай [нужны данные] и спрашивай, а не придумывай за меня.

Три готовых сценария

Каркасы под частые задачи: меняете то, что в угловых скобках, остальное оставляете.

Ролик услуги для соцсетей

Промпт
<специалист> за работой: <короткое действие, одно движение>,
камера медленно приближается, дневной свет из окна,
документальная съёмка, тёплые естественные цвета,
звук: рабочие шумы помещения, тихая ритмичная музыка,
вертикальный кадр 9:16

Одно действие, один персонаж, никаких переходов внутри сцены — это и делает ролик
пригодным для монтажа с соседними.

Товар в действии

Промпт
<товар> на однотонной поверхности, предмет медленно поворачивается,
облёт камеры вокруг объекта, мягкий студийный свет сверху,
рекламная предметная съёмка, глубокие тени,
звук: тихий фоновый гул студии, без музыки,
горизонтальный кадр 16:9

Отсутствие музыки здесь осознанное: под такой ролик её обычно подставляют при монтаже
под конкретную площадку.

Сцена мультика

Промпт
<персонаж: короткое описание внешности> в <место>,
<одно простое действие>, камера статична,
мультипликация, мягкие формы, насыщенные цвета,
звук: реплика персонажа «<фраза до семи слов>», лёгкая музыка,
вертикальный кадр 9:16

Описание внешности персонажа переносится из сцены в сцену дословно — так герой остаётся
похожим на себя. В версии 3.1 для этого есть отдельный режим, но повторение описания
работает и без него.


Где чаще всего ошибаются

Пытаются уместить историю в одну сцену. Восемь секунд — это одно действие. Смена
места, второй персонаж, поворот сюжета внутри одной генерации превращаются в кашу.

Забывают про звук. У модели со звуком его нужно описывать так же подробно, как
картинку, иначе получится случайная музыка поверх нужной сцены.

Берут горизонтальный формат по привычке. Для коротких видео нужен вертикальный кадр,
и задаётся он до генерации: кадрирование после съедает композицию.

Ждут точного текста на экране. Надписи в видео по-прежнему выходят неровно. Текст
надёжнее накладывать при монтаже.

Считают попытки картинками. На один пригодный ролик уходит несколько генераций,
и на платных тарифах это заметная часть расхода.


Чем Veo отличается от конкурентов по задачам

Сравнение имеет смысл вести не по «качеству вообще», а по тому, что нужно в конкретной работе.

Что нужноГде сильнееПочему
Звук вместе с картинкойVeoостальные отдают немой ролик, звук собирается отдельно
Достоверная физика движенияVeo и Klingоба заметно опережают более простые генераторы
Длинная сцена без склейкиKlingдопускает более продолжительные фрагменты
Работа без VPN и оплата рублямироссийские сервисывопрос доступа, а не качества
Мультипликация и условный стильпочти любойусловность скрывает слабые места моделей
Точный текст в кадрениктонадписи добавляются при монтаже

Из таблицы видно главное: выбор генератора почти всегда упирается не в качество картинки,
а в две вещи — нужен ли вам звук в кадре и готовы ли вы возиться с доступом.


Словарь движений камеры

Отдельный словарь, который в промпте для видео работает так же, как словарь света
для фотографии.

ФормулировкаЧто получится
статичный кадркамера не двигается, движется только сцена
медленный наездкамера приближается, внимание стягивается к предмету
отъездкадр раскрывается, зритель видит контекст
проезд сбокукамера идёт параллельно движению героя
съёмка с рукилёгкая тряска, ощущение репортажа
облёт вокруг объектапредмет показывается со всех сторон
съёмка сверху внизобзорный план, схема происходящего

Одно движение на сцену. Наезд с одновременным облётом и сменой плана даёт хаотичный кадр,
который потом невозможно смонтировать с соседними.


Как проверить готовый ролик

Четыре проверки перед публикацией — по ним видно, годится ролик или его надо переделывать.

Связность движения: посмотрите ролик без звука. Если предметы дёргаются, а фон
«переливается» между кадрами, зритель это заметит даже подсознательно.

Стыки сцен: включите переход между двумя сценами и посмотрите три раза подряд. Смена
направления движения или света на стыке — самая заметная ошибка ИИ-видео.

Звук против картинки: закройте глаза и послушайте. Если звук не совпадает с тем, что
происходит в кадре, лучше заменить его при монтаже.

Первая секунда: короткие видео смотрят с первой секунды. Если в ней ничего не происходит,
остальное уже неважно.


Частые вопросы

Veo работает в России?

Официально нет. Сайт Gemini открывается, но инструмент Flow с российского адреса
показывает страницу «регион не поддерживается», а аккаунт с российской страной не пускают
к генерации даже под VPN. Нужны и VPN, и аккаунт другой страны, и зарубежная карта.

Чем Veo отличается от Kling и Runway?

Главное отличие — звук, который генерируется вместе с картинкой. По физике движения Veo
и Kling сопоставимы, но Kling доступнее из России. Разбор Kling — здесь.

Сколько длится ролик?

Одна сцена — около восьми секунд. Длинные ролики собираются из сцен в Flow, суммарно
до пары минут.

Можно ли сделать сериал с одним персонажем?

Да, для этого в версии 3.1 есть режим устойчивых персонажей: герой сохраняет внешность
между сценами. Это то, чего раньше не хватало для мультиков и рекламных серий.

Нужен ли монтажный редактор или хватит генератора?

Для одной сцены хватит генератора. Как только роликов больше одного, нужен монтаж: склейка,
подгонка звука, титры. Подойдёт любой привычный редактор, в том числе бесплатный —
разбор инструментов есть в материале про ИИ для монтажа видео.

Как быть с озвучкой, если генератор без звука?

Звук собирается отдельно: реплики — в сервисе синтеза речи, шумы и музыка — из библиотек.
Что из этого работает из России, разобрано в материале про
нейросеть для озвучки видео.

Что выбрать, если нужен поток роликов на русском?

Российские сервисы: они без VPN, понимают русский и оплачиваются рублями. Как выстроить
из этого рабочий конвейер коротких видео, разобрано в нашем наборе инструментов:
Reels Machine.

Способ зарабатывать на ИИ
Зарабатывайте на создании сайтов и ИИ-агентов
  • Собираете клиенту сайт и ИИ-продавца за вечер вместо недель разработки
  • Конструктор сайтов и ИИ-сотрудники — в одном российском сервисе
  • Бонус 1 000 ₽ при регистрации по этой ссылке вместо обычных 500 ₽
Начать бесплатно
Регистрация занимает минуту, без VPN и иностранных карт

🍋Ещё статьи в категории «ИИ-видео и нейромультики»

В категорию
ИИ для монтажа видео: 7 сервисов, цены и что они реально умеют
21.08.2026#ИИ-видео и нейромультики
ИИ для монтажа видео: 7 сервисов, цены и что они реально умеют
Фраза «нейросеть смонтирует за вас» продаётся лучше, чем работает. На деле ИИ закрывает четыре операции монтажа — и час работы превращается в десять минут.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Видео для маркетплейсов: что снимать, что генерировать и как приводить внешний трафик
16.08.2026#ИИ-видео и нейромультики
Видео для маркетплейсов: что снимать, что генерировать и как приводить внешний трафик
Видео на маркетплейсе работает в двух разных местах: внутри карточки снижает возвраты, снаружи приводит людей, которых внутренняя реклама уже не приводит.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
ИИ-аватар: как сделать говорящее видео из фото, какие сервисы работают из России и сколько это стоит
14.08.2026#ИИ-видео и нейромультики
ИИ-аватар: как сделать говорящее видео из фото, какие сервисы работают из России и сколько это стоит
Одна фотография плюс текст — и человек в кадре говорит вашими словами. Разбираем, как это устроено внутри, что работает из России и почему у одних выходит дорого, а у других как мем.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Видеопоздравление своими руками: четыре способа сделать за 15 минут
14.08.2026#ИИ-видео и нейромультики
Видеопоздравление своими руками: четыре способа сделать за 15 минут
Поздравление, за которое раньше платили тысячи, собирается дома за пятнадцать минут: фотография, пара фраз и бесплатный сервис.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Клип нейросетью: как собрать музыкальное видео за вечер и сколько это стоит
14.08.2026#ИИ-видео и нейромультики
Клип нейросетью: как собрать музыкальное видео за вечер и сколько это стоит
Клип на песню собирается за вечер и стоит несколько сотен рублей. Разбираем весь путь: раскадровка, единый стиль, монтаж по ритму и вопрос прав на музыку.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Как сделать Reels: от идеи до заявок — хуки, эмоции и масштабирование ИИ-мультиками
14.08.2026#ИИ-видео и нейромультики
Как сделать Reels: от идеи до заявок — хуки, эмоции и масштабирование ИИ-мультиками
Разница между роликом на двести просмотров и роликом на миллион почти никогда не в камере. Разбираем, что решает: хук, эмоция и путь от просмотра к заявке.
Дмитрий Борейчук
Автор
Дмитрий Борейчук

🏆Другие категории

Все категории