Что модель умеет сейчас
Восемь секунд на сцену — не ограничение конкретно Veo, а общее свойство нынешних видеомоделей: дальше связность распадается. Поэтому длинные ролики везде собираются из коротких сцен, и работа с монтажом становится частью процесса.
Где им пользуются: четыре разных входа
Flow здесь ключевой инструмент: это не просто окно генерации, а среда, где ролик собирается из сцен, задаются опорные кадры и хранятся варианты. Именно в нём получаются осмысленные ролики, а не отдельные восьмисекундные отрывки.
Сколько это стоит
Отдельной подписки на Veo нет — доступ идёт через общие тарифы Google на ИИ.
Рубли пересчитаны по курсу Центробанка на 25 августа 2026 года — 83,29 ₽ за доллар. Отдельно стоит учитывать расход попыток: на один пригодный ролик уходит от трёх до десяти генераций, и лимиты тарифа кончаются быстрее, чем ожидаешь.
Доступ из России
Здесь всё честно и неприятно.
Сайт Gemini из России открывается, но это ничего не значит: Google смотрит не только на адрес подключения, но и на страну аккаунта. Инструмент Flow, через который и делают нормальные ролики, из России сразу уводит на страницу «регион не поддерживается» (на 25 августа 2026 года).
Что это означает на практике:
- VPN нужен постоянно, а не только на регистрацию;
- аккаунт должен быть с другой страной — российского региона в профиле достаточно для отказа даже под VPN;
- оплата российской картой не пройдёт: нужна карта иностранного банка или посредник;
- бесплатный уровень тоже закрыт — он привязан к тому же аккаунту.
Итог: Veo из России доступен, но через несколько ухищрений сразу, и это осознанный выбор ради конкретного результата — сцен со звуком, которых больше почти никто не даёт.
Чем заменить: что работает без VPN
Подробное сравнение российских и зарубежных видеогенераторов, включая то, что осталось после закрытия Sora, разобрано отдельно:
нейросеть для создания видео и чем заменить Sora.
Практический вывод: если задача — поток коротких роликов для соцсетей на русском, российские сервисы закрывают её без VPN и карт. Veo берут тогда, когда нужен звук в кадре и достоверная физика — например, для рекламного ролика, где видно каждую деталь.
Есть и обходной путь к самому Veo: модель Veo 3.1 официально доступна внутри Runway наравне с Kling и Seedance — то есть одна подписка даёт доступ сразу к нескольким генераторам, а сайт Runway открывается из России без обходных путей. Разбор тарифов в кредитах и расчёт цены секунды видео — в обзоре Runway.
Veo 3.1 есть и внутри InVideo AI: кадр Veo 3.1 Fast в 4K на 8 секунд со звуком стоит там 96 кредитов, то есть от 109 до 246 ₽ в зависимости от тарифа. Сверка этих кредитов с прайсом Google в обзоре InVideo AI.
Как собрать ролик из сцен: рабочий процесс
Готовое видео почти никогда не выходит одной генерацией. Порядок, который экономит время и деньги, выглядит так.
Пятый шаг чаще всего делают неправильно. Отбирают кадр, который понравился сам по себе, а потом он не стыкуется с соседними: движение идёт в другую сторону, свет меняется, персонаж выглядит иначе. Смотреть надо сразу парами: как эта сцена встанет рядом с предыдущей.
Сколько стоит минута готового видео
Считать удобнее не в генерациях, а в минутах итогового ролика.
Минута видео — это примерно восемь сцен по восемь секунд. На каждую сцену уходит от трёх до пяти генераций, пока не получится пригодный вариант. Итого на минуту готового ролика — порядка тридцати генераций.
Отсюда практический вывод: лимиты тарифа надо считать по попыткам, а не по числу нужных роликов. Тариф, рассчитанный «одна генерация — одна сцена», кончается на середине первого же проекта.
Что Veo пока не умеет
Честный список ограничений, общих почти для всех видеомоделей.
Права, водяные знаки и реклама
Вопрос, который всплывает, когда ролик уже готов и его пора публиковать.
Все видео, сгенерированные моделями Google, помечаются технологией SynthID: невидимый глазу маркер встраивается прямо в пиксели кадров и переживает сжатие, обрезку и цветокоррекцию. Это не водяной знак поверх картинки, а способ подтвердить, что видео сгенерировано.
Коммерческое использование результата на платных тарифах разрешено, но условия отличаются по типу подписки, и перед серьёзным проектом их стоит перечитать в актуальной редакции: у корпоративных и премиальных планов права шире, чем у базовых.
Отдельно про российские требования: маркировка рекламы и правила о персональных данных работают независимо от того, снят ролик камерой или сгенерирован. Если в кадре узнаваемый человек — нужно согласие; если ролик рекламный — нужна маркировка.
Для каких задач это реально применимо
Общее правило то же, что и с картинками: генерация выигрывает там, где нужна атмосфера и условность, и проигрывает там, где нужна документальная точность и конкретика вашего бизнеса.
Как писать промпт для видео
Промпт для видео отличается от промпта для картинки одним: кроме кадра нужно описать, что происходит за эти секунды и как движется камера.
Рабочая структура выглядит так:
- Кто или что в кадре — герой, предмет, сцена.
- Что происходит — действие целиком, без резких смен: восемь секунд не вмещают две сцены.
- Как движется камера — статичный кадр, наезд, отъезд, проезд сбоку, съёмка с руки.
- Свет и время суток — тот же словарь, что и для фотографии.
- Стиль — документальная съёмка, кинокадр, мультипликация, 3D-рендер.
- Звук — реплики персонажей в кавычках, окружающие шумы, характер музыки.
- Формат — горизонтальный или вертикальный кадр.
Пример собранного промпта:
Пожилой мастер в автосервисе поднимает капот и заглядывает внутрь,
медленный наезд камеры на его лицо, утренний свет из открытых ворот,
документальная съёмка, зерно плёнки, звук: щелчок замка капота,
далёкий шум мастерской, реплика: «Ну, посмотрим, что тут у нас»,
вертикальный кадр 9:16
Разбор промптов для статичных изображений — со словарями света, ракурсов и оптики — в отдельном материале:
нейросеть для генерации изображений.
Готовый промпт-ассистент
Скопируйте в любую чат-модель — ГигаЧат, Алису, ChatGPT — и отвечайте своими словами. На выходе получите готовый промпт для видеогенератора и раскадровку из нескольких сцен.
Ты — режиссёр коротких роликов, который последние три года переводит
сценарии на язык видеогенераторов. Ты знаешь, что одна сцена длится
около восьми секунд, что за это время нельзя показать две разные ситуации
и что звук описывается отдельно от картинки.
ЗАДАЧА
Собрать для меня промпт под видеогенератор и раскадровку ролика.
ПОРЯДОК РАБОТЫ
1. Спроси, для чего ролик и где он будет опубликован: [моя задача и площадка].
2. Спроси, что должно произойти в кадре и кто в нём: [что в кадре].
3. Спроси, какое действие должен совершить зритель после просмотра:
[действие зрителя].
4. Спроси про ограничения: фирменные цвета, чего быть не должно,
нужен ли текст на экране: [мои ограничения].
5. Спроси, в каком генераторе я буду запускать и есть ли у него звук:
[мой генератор].
6. Разбей замысел на сцены по восемь секунд и покажи раскадровку:
номер сцены, что происходит, движение камеры, звук.
7. Для каждой сцены собери промпт по структуре: кто и что в кадре, действие,
движение камеры, свет, стиль, звук, формат.
8. Предложи три варианта первой сцены с разными зацепками для зрителя
и объясни, чем они отличаются.
9. Назови, что проверить в готовом ролике: связность движения, лица и руки,
попадание звука в картинку.
ФОРМАТ ОТВЕТА
Сначала раскадровка таблицей: сцена, что происходит, камера, звук, длительность.
Затем промпты по сценам отдельными блоками, готовые к копированию. Затем три
варианта первой сцены. В конце — список проверок для готового ролика.
ПРАВИЛА
Не вмещай две ситуации в одну сцену: это главная причина, по которой ролик
разваливается. Не используй отрицания в описании кадра — описывай то, что есть.
Реплики персонажей давай в кавычках и короткими, до семи слов. Если генератор
без звука, скажи об этом и предложи, чем озвучивать отдельно. Чего не хватает —
помечай [нужны данные] и спрашивай, а не придумывай за меня.
Следующий шаг: соберите ии-режиссёра, который раскладывает ролик на сцены и пишет промпты
Промпт вставляется в Ною как инструкция ИИ-сотрудника без правок. Дальше в Телеграме вы описываете, для чего ролик и где он выйдет — Reels, VK, карточка товара, сотрудник задаёт уточняющие вопросы и присылает раскадровку по сценам с готовыми промптами и звуком для видеогенератора. Перед следующим роликом достаточно описать новый сюжет: площадку и ограничения объяснять заново не нужно.
- Фирменные цвета, площадки публикации и правила про текст на экране вписываются в инструкцию один раз — повторять их перед каждым новым роликом не придётся.
- Удачные промпты и раскадровки можно сохранить в базе знаний сотрудника и присылать как образец, когда нужен ролик в той же стилистике.
- Российский сервис, оплата в рублях, 7 дней бесплатно и без карты. По ссылке из статьи на ответы начисляется 1 000 ₽ вместо 500 ₽.
Собрать ИИ-режиссёра в Ное →
Три готовых сценария
Каркасы под частые задачи: меняете то, что в угловых скобках, остальное оставляете.
Ролик услуги для соцсетей
<специалист> за работой: <короткое действие, одно движение>,
камера медленно приближается, дневной свет из окна,
документальная съёмка, тёплые естественные цвета,
звук: рабочие шумы помещения, тихая ритмичная музыка,
вертикальный кадр 9:16
Одно действие, один персонаж, никаких переходов внутри сцены — это и делает ролик пригодным для монтажа с соседними.
Товар в действии
<товар> на однотонной поверхности, предмет медленно поворачивается,
облёт камеры вокруг объекта, мягкий студийный свет сверху,
рекламная предметная съёмка, глубокие тени,
звук: тихий фоновый гул студии, без музыки,
горизонтальный кадр 16:9
Отсутствие музыки здесь осознанное: под такой ролик её обычно подставляют при монтаже под конкретную площадку.
Сцена мультика
<персонаж: короткое описание внешности> в <место>,
<одно простое действие>, камера статична,
мультипликация, мягкие формы, насыщенные цвета,
звук: реплика персонажа «<фраза до семи слов>», лёгкая музыка,
вертикальный кадр 9:16
Описание внешности персонажа переносится из сцены в сцену дословно — так герой остаётся похожим на себя. В версии 3.1 для этого есть отдельный режим, но повторение описания работает и без него.
Где чаще всего ошибаются
Пытаются уместить историю в одну сцену. Восемь секунд — это одно действие. Смена места, второй персонаж, поворот сюжета внутри одной генерации превращаются в кашу.
Забывают про звук. У модели со звуком его нужно описывать так же подробно, как картинку, иначе получится случайная музыка поверх нужной сцены.
Берут горизонтальный формат по привычке. Для коротких видео нужен вертикальный кадр, и задаётся он до генерации: кадрирование после съедает композицию.
Ждут точного текста на экране. Надписи в видео по-прежнему выходят неровно. Текст надёжнее накладывать при монтаже.
Считают попытки картинками. На один пригодный ролик уходит несколько генераций, и на платных тарифах это заметная часть расхода.
Чем Veo отличается от конкурентов по задачам
Сравнение имеет смысл вести не по «качеству вообще», а по тому, что нужно в конкретной работе.
Из таблицы видно главное: выбор генератора почти всегда упирается не в качество картинки, а в две вещи — нужен ли вам звук в кадре и готовы ли вы возиться с доступом.
Словарь движений камеры
Отдельный словарь, который в промпте для видео работает так же, как словарь света для фотографии.
Одно движение на сцену. Наезд с одновременным облётом и сменой плана даёт хаотичный кадр, который потом невозможно смонтировать с соседними.
Как проверить готовый ролик
Четыре проверки перед публикацией — по ним видно, годится ролик или его надо переделывать.
Связность движения: посмотрите ролик без звука. Если предметы дёргаются, а фон «переливается» между кадрами, зритель это заметит даже подсознательно.
Стыки сцен: включите переход между двумя сценами и посмотрите три раза подряд. Смена направления движения или света на стыке — самая заметная ошибка ИИ-видео.
Звук против картинки: закройте глаза и послушайте. Если звук не совпадает с тем, что происходит в кадре, лучше заменить его при монтаже.
Первая секунда: короткие видео смотрят с первой секунды. Если в ней ничего не происходит, остальное уже неважно.
Частые вопросы
Veo работает в России?
Официально нет. Сайт Gemini открывается, но инструмент Flow с российского адреса показывает страницу «регион не поддерживается», а аккаунт с российской страной не пускают к генерации даже под VPN. Нужны и VPN, и аккаунт другой страны, и зарубежная карта.
Чем Veo отличается от Kling и Runway?
Главное отличие — звук, который генерируется вместе с картинкой. По физике движения Veo и Kling сопоставимы, но Kling доступнее из России. Подробный разбор — в обзоре Kling AI.
Сколько длится ролик?
Одна сцена — около восьми секунд. Длинные ролики собираются из сцен в Flow, суммарно до пары минут.
Можно ли сделать сериал с одним персонажем?
Да, для этого в версии 3.1 есть режим устойчивых персонажей: герой сохраняет внешность между сценами. Это то, чего раньше не хватало для мультиков и рекламных серий.
Нужен ли монтажный редактор или хватит генератора?
Для одной сцены хватит генератора. Как только роликов больше одного, нужен монтаж: склейка, подгонка звука, титры. Подойдёт любой привычный редактор, в том числе бесплатный — разбор инструментов есть в материале про ИИ для монтажа видео.
Как быть с озвучкой, если генератор без звука?
Звук собирается отдельно: реплики — в сервисе синтеза речи, шумы и музыка — из библиотек. Что из этого работает из России, разобрано в материале про нейросеть для озвучки видео.
Что выбрать, если нужен поток роликов на русском?
Российские сервисы: они без VPN, понимают русский и оплачиваются рублями. Как выстроить из этого рабочий конвейер коротких видео, разобрано в нашем наборе инструментов:
Reels Machine.