Самый частый запрос про модель Google в русском поиске — «Veo 3». Загвоздка в том, что версии Veo 3 больше нет: Google отключил её 30 июня 2026 года вместе с Veo 2. Работает поколение 3.1, а почти все русскоязычные обзоры в выдаче разбирают модель, которой уже два месяца как не существует.
Дальше по порядку: на что модель способна на самом деле, чем 3.1 отличается от отключённой тройки, почему она не открывается из России и сколько стоит одна генерация, если считать не в абстрактных кредитах, а в рублях. Все характеристики сверены с документацией Google 26 августа 2026 года.
Что такое Veo и кто её сделал
Название Veo носит семейство моделей генерации видео от Google DeepMind, подразделения, которое занимается исследованиями искусственного интеллекта внутри Google. Вы описываете сцену текстом, модель выдаёт готовый ролик со звуком. Можно добавить фотографию или несколько, и тогда генерация будет отталкиваться от них.
В русском тексте название часто пишут как «Вео», в поиске встречаются оба написания. Мы держимся латиницы: именно в этом виде модели подписаны в интерфейсах, и в этом же виде название пишет сам Google.
Главное отличие от большинства соседей по рынку — это звук. Обычные генераторы видео отдают беззвучную картинку, аудио накладывают потом. Veo создаёт звуковую дорожку сама: шаги, шум улицы, музыку, реплики персонажей с попаданием в артикуляцию. Не постобработка, а часть той же генерации.
Второе отличие — управляемость. Модель понимает язык съёмки: план, движение камеры, тип освещения. Запрос «медленный наезд на лицо, контровой свет, ручная камера» она отработает как инструкцию оператору, а не как набор прилагательных.
Сама по себе Veo — модель, а не приложение. Пользователь встречается с ней внутри чего-то: сервиса Google, стороннего интерфейса или агрегатора нейросетей. Различие пригодится в следующем разделе.
Veo 3 отключили: какие версии работают на август 2026
Здесь начинается расхождение между тем, что пишут в обзорах, и тем, что происходит у Google.
Что именно выключили и когда
15 июня 2026 года Google объявил вывод трёх моделей из эксплуатации, 30 июня исполнил. Список с официальной страницы депрекаций Gemini API:
| Модель | Идентификатор | Статус |
|---|---|---|
| Veo 2 | veo-2.0-generate-001 |
отключена 30.06.2026 |
| Veo 3 | veo-3.0-generate-001 |
отключена 30.06.2026 |
| Veo 3 Fast | veo-3.0-fast-generate-001 |
отключена 30.06.2026 |
| Veo 3.1 | veo-3.1-generate-preview |
работает |
| Veo 3.1 Fast | veo-3.1-fast-generate-preview |
работает |
| Veo 3.1 Lite | veo-3.1-lite-generate-preview |
работает |
Переходить Google предлагает на поколение 3.1. Даты вывода у него не объявлено ни для одного из трёх вариантов — на конец августа 2026 года оно считается текущим.
Практический вывод простой. Если инструкция обещает вам тройку, она устарела, и вопрос лишь в том, насколько сильно. Использовать Veo вы в любом случае будете в редакции 3.1.
Почему разница важна для читателя, а не только для разработчика. Когда производитель выключает модель, сервисы, которые к ней подключались, либо переводят пользователей на свежее поколение молча, либо снимают позицию из каталога. Инструкция, написанная под тройку, ведёт вас к кнопке, которой в интерфейсе уже нет, и половина непонимания в комментариях под старыми обзорами растёт именно отсюда.
Чем поколение 3.1 отличается от тройки
Обновление вышло 15 октября 2025 года и добавило четыре вещи.
Продление сцены. Запись можно наращивать кусками, отталкиваясь от последней секунды предыдущего фрагмента. Из восьмисекундных блоков собирается видео длиннее минуты.
Референсные изображения. Режим, который Google называет Ingredients to Video: вы даёте несколько картинок с персонажем, предметом или нужным стилем, и модель удерживает их узнаваемыми.
Переход между двумя кадрами. Указываете первый и последний кадр, дальше система достраивает движение между ними.
Звук во всех перечисленных режимах. В тройке аудио работало не везде; в обновлении оно есть и при генерации по референсам, и при переходе, и при продлении сцены.
Плюс к тому обновление стало аккуратнее в главном — в генерации видео из картинки, и научилось выдавать 4K и полноценную вертикаль.
Fast и Lite: когда хватает их
Внутри поколения три варианта, и различаются они ценой и качеством, а не набором функций.
- Veo 3.1 — основная. Максимальное качество, доступно 4K.
- Veo 3.1 Fast отдаёт результат быстрее и заметно дешевле, 4K тоже есть.
- Veo 3.1 Lite самая экономичная, вышла 31 марта 2026 года. 4K не поддерживает.
Разница в цене у самого Google восьмикратная: 0,40 доллара за секунду у основной модели против 0,05 у Lite в разрешении 720p. Для черновой раскадровки, где важно быстро проверить идею, Lite обычно достаточно. Финал имеет смысл гонять на основной.
Что модель умеет: характеристики на 26 августа 2026
Цифры ниже — из документации Gemini API, а не из пересказов. Сверяться с ними стоит регулярно: за последний год поколения менялись четыре раза.
Длительность, разрешение, формат кадра
| Параметр | Что доступно |
|---|---|
| Длительность одной записи | 8, 6 или 4 секунды |
| Разрешение | 720p по умолчанию, 1080p, 4K |
| Соотношение сторон | 16:9 (горизонталь) и 9:16 (вертикаль) |
| Генераций за один запрос | одна |
Есть важная связка: 1080p, 4K, продление сцены и работа с референсными картинками требуют длительности ровно восемь секунд. Укоротить до четырёх или шести можно только в базовом сценарии «текст в видео» на 720p.
Вертикаль в обновлении генерируется полным кадром, а не обрезается из горизонтальной картинки. Для соцсетей разница принципиальная: при кропе из 16:9 у персонажа регулярно уезжала голова за границу.
Звук, который модель придумывает сама
Аудио в поколении 3.1 включено всегда — отключить его параметром нельзя ни в одном из трёх вариантов. Система генерирует три слоя: фоновую атмосферу места, эффекты от действий в кадре и речь персонажей.
Речь синхронизируется с губами. Работает и на русском, хотя качество липсинка на русской реплике заметно ниже, чем на английской — артикуляция расходится на длинных фразах. Короткие реплики отрабатываются чисто.
Управлять звуком можно прямо из запроса: описать шум, задать музыку словами, дать персонажу прямую речь в кавычках. Отдельного поля под аудио нет.
Продление сцены: запись длиннее минуты
Восемь секунд — потолок одной генерации, и обойти его напрямую нельзя. Ограничение снимают продлением: каждый следующий фрагмент строится от последней секунды предыдущего, и набирается минута и больше.

У метода есть цена. Каждое продление — отдельная генерация, то есть отдельные деньги, и каждое немного уводит картинку от исходной: к пятому-шестому блоку персонаж часто уже не тот. Практика здесь та же, что в монтаже: длинную сцену дешевле собрать из нескольких коротких планов, чем тянуть одним куском.
Референсы: как удержать одного персонажа
Главная боль генеративного видео — персонаж меняется от запроса к запросу. В обновлении под неё сделан режим с референсными изображениями: вы прикладываете несколько фотографий человека, товара или интерьера, и модель синтезирует сцену, сохраняя внешность и фон.
Для коммерческих задач это и есть решающая функция. Серия материалов про один товар без неё разваливается: в каждой сцене упаковка выглядит немного иначе.
Готовый файл лежит на сервере двое суток
Деталь, которую не пишут почти нигде, а она стоит денег. Сгенерированное видео хранится на стороне Google двое суток, после чего удаляется. Не скачали — генерируйте заново и платите заново.
Привычка забирать файл сразу после генерации экономит больше, чем любая оптимизация запроса.
Куда делся Veo в приложении Gemini
Второе расхождение с обзорами. В потребительском приложении Gemini видео теперь делает другая модель.
30 июня 2026 года Google выпустил Gemini Omni Flash и, по формулировке самой компании, Gemini Omni заменяет Veo в приложении Gemini. Omni мультимодальна: она и генерирует видео, и правит его дальше в диалоге, обычными репликами вроде «убери прохожего слева».
Подписки Google AI Plus и Google AI Ultra — единственный способ добраться до неё легально. Что у Omni в приложении: записи по 10 секунд, до пяти фотографий на вход, свой звук, возраст 18+ и подписка Google AI Plus, Pro или Ultra.
При этом Veo 3.1 никуда не делась — осталась в Gemini API и продолжает продаваться. Разделение получилось такое:
- приложение Gemini — там Omni, и старую модель вы там уже не увидите;
- Gemini API и всё, что через него работает, — там поколение 3.1, и именно его вы получаете в сторонних сервисах.
Получается, что нейросеть Veo сегодня — инструмент для интеграций, а не кнопка внутри продукта Google для конечного пользователя. Для читателя из России разница чисто теоретическая, и вот почему.
Почему Veo не открывается из России
Ограничение страновое, а не платёжное
Расхожее объяснение — «не проходит зарубежная карта». Оно неверно, точнее, неполно.
У Google есть официальный список стран и территорий, где доступно приложение Gemini. В списке больше 230 позиций, и России среди них нет. Формулировка компании: доступ расширяется постепенно, сообразно местному регулированию и принципам работы с искусственным интеллектом. Отсечение происходит по стране, до всякой оплаты.

Та же схема у Anthropic с Claude: дело не в банке, а в перечне поддерживаемых стран. Способов обхода мы здесь не даём — тема отдельная, с собственными рисками, и к предмету статьи она не относится.
Подписка Google — второй барьер
Даже если бы страновой вопрос снялся, остался бы платёжный. Генерация видео в приложении Gemini требует подписки Google AI Plus, Pro или Ultra — то есть карты иностранного банка и активной подписки в валюте.
В Gemini API картина ещё жёстче: бесплатного уровня у Veo нет ни у одного варианта поколения. Любая генерация платная с первой секунды, и оплачивается она так же, картой.
Итого два независимых барьера, снимать надо оба.
Как использовать Veo из России через chad
Пользоваться Veo из России напрямую не выйдет, и рабочий путь здесь один — сервис-агрегатор, у которого доступ к модели уже настроен, а оплата идёт российской картой в рублях. В chad поколение 3.1 подключено, и в интерфейсе оно стоит рядом с остальными видеомоделями — посадочная страница модели показывает, как выглядит результат.
По шагам
- Зарегистрируйтесь в chad — по почте или через Telegram-бот. Сервис работает в браузере и в приложениях для Android и iOS.
- Откройте раздел генерации видео и выберите в списке Veo 3.1.
- Опишите сцену текстом. При необходимости приложите картинку — она задаст стартовую точку или внешность персонажа.
- Запустите генерацию и дождитесь результата.
- Сразу скачайте файл. Про двое суток хранения помним.
Что проверить перед первой генерацией
Каталог моделей в сервисе меняется — варианты добавляются и снимаются вслед за производителями. Перед работой откройте актуальный список и убедитесь, что нужная позиция на месте: то, что было в прайсе весной, не обязательно там в конце лета. Мы сами убедились в том на примере Sora, которую OpenAI закрыла в апреле 2026 года, пока она ещё продавалась.
И второе: первую попытку лучше делать на короткой простой сцене. Не потому, что модель не потянет сложную, а потому что за каждую генерацию списываются деньги, и первый запрос почти никогда не бывает удачным.
Сколько выходит по деньгам: считаем в готовых роликах
Цену обычно называют в единицах, которые ничего не говорят. Переведём в понятное.
Цена одной генерации на трёх тарифах
Внутренняя валюта chad — искры. В тарифах на 26 августа 2026 года Veo 3.1 стоит 60 000 искр за генерацию плюс слова самого запроса. Есть отдельная позиция «Veo 3.1 (Стабильная)» — от 180 000 искр.
Пакеты и то, во что они превращаются:
| Тариф | Цена | Искр в пакете | Одна генерация | Генераций из пакета |
|---|---|---|---|---|
| Мини | 290 ₽ | 120 000 | ≈ 145 ₽ | около 2 |
| Опти | 590 ₽ | 300 000 | ≈ 118 ₽ | около 5 |
| Плюс | 1 690 ₽ | 900 000 | ≈ 112 ₽ | около 15 |
В последнем столбце пакет поделён на цену генерации. Слова запроса тоже тратят искры, поэтому реальное количество будет чуть меньше. «Стабильная» при 180 000 искр обойдётся втрое дороже, порядка 337 рублей.

Искры при этом расходуются на все модели сервиса, а не только на видео. Если вы параллельно пишете тексты и делаете картинки, пакет уйдёт быстрее.
Сколько то же самое стоит у Google
Для ориентира — прайс Gemini API на ту же дату:
| Модель | Цена за секунду | Восемь секунд |
|---|---|---|
| Veo 3.1, 1080p | $0,40 | $3,20 |
| Veo 3.1, 4K | $0,60 | $4,80 |
| Veo 3.1 Fast, 1080p | $0,12 | $0,96 |
| Veo 3.1 Lite, 1080p | $0,08 | $0,64 |
Сравнение здесь скорее для ориентира, чем для выбора: прямой доступ к Gemini API из России всё равно закрыт, и вопрос «дешевле или дороже» упирается в то, что у одного из вариантов цены нет вовсе, потому что нет доступа.
Как писать промпт для Veo
Промпт — текстовое описание, по которому модель строит сцену. Для видео он устроен иначе, чем для картинки: кроме содержания нужно задать время — что и как меняется за восемь секунд.
Из чего состоит рабочий промпт
Разберём по блокам. Порядок не строгий, но все шесть элементов лучше держать в голове.
- Кто и что в сцене. Возраст, одежда, характер, состояние. «Женщина» — плохо, «женщина лет сорока в рабочем фартуке, уставшая» — хорошо.
- Где. Место, время суток, погода. Пространство диктует свет.
- Действие. Ровно одно на восемь секунд. Два подряд модель смешивает в кашу.
- Камера. План (крупный, средний, общий) и движение: наезд, отъезд, проводка, статика. Если движение не задано, система часто добавляет лёгкую тряску от руки по своей инициативе.
- Свет и стиль. Контровой, мягкий рассеянный, неон, плёночное зерно. Два определения, не пять.
- Звук. Атмосфера, эффекты, реплики.
Главная ошибка новичка — набор прилагательных без действия. «Красивый закат, кинематографично, 4K, детализация» даст статичную открытку. Модель нужно просить не о качестве, а о происходящем.
Как задать реплики и звук
Прямую речь пишут в кавычках и приписывают конкретному персонажу. Работает конструкция вида: «бариста поворачивается к камере и говорит: „ваш кофе готов“». Реплику держите короткой — на длинной фразе липсинк расходится.
Атмосферу описывайте отдельным предложением: шум дождя по жести, гул кафе на заднем плане, тишина с одним тикающим будильником. Если звук не описан вовсе, система придумает его сама, и результат будет непредсказуем.
Три готовых промпта под разные задачи
Товар для карточки в маркетплейсе. «Средний план: керамическая кружка кофе на деревянном столе у окна, пар медленно поднимается. Камера делает плавный наезд на кружку. Мягкий утренний свет сбоку, тёплые тона, малая глубина резкости. Звук: тихий гул кафе, звон посуды вдалеке».
Атмосферная сцена для соцсетей, вертикаль. «Вертикальный кадр 9:16: подросток в наушниках идёт по ночной улице под дождём, неоновые вывески отражаются в лужах. Камера движется за ним на уровне плеч, ручная съёмка. Холодный синий свет, плёночное зерно. Звук: дождь по асфальту, приглушённый бит из наушников».
Говорящий персонаж для объясняющего видео. «Крупный план: мужчина в очках и сером свитере сидит за столом в светлом офисе, смотрит в камеру и говорит: „начнём с главного“. Камера статична. Ровный рассеянный свет из окна слева. Звук: тихий фон офиса, без музыки».
Как отличить свежую инструкцию от устаревшей
Материалов про генерацию видео в русском поиске много, и половина описывает то, чего уже нет. Свежесть проверяется по четырём признакам.
Номер поколения в тексте. Если статья разбирает тройку как действующую модель, она написана до конца июня 2026 года. Дальше можно не читать: характеристики, цены и порядок работы там будут прошлогодними.
Дата рядом с характеристиками. Добросовестная инструкция пишет «на такое-то число» рядом с цифрами. Плохая даёт разрешение и длительность без привязки ко времени, и понять, когда их снимали, невозможно.
Ссылки на первоисточник. Разрешения, длительность и цены опубликованы в документации Google, и внимательный автор на неё ссылается. Пересказ пересказа накапливает ошибки: встречаются материалы, где длительность выросла вдвое просто из-за цепочки перепечаток.
Упоминание приложения Gemini как места, где живёт модель. После июньского обновления там работает Omni. Если текст ведёт вас туда за видео от Veo, он отстал минимум на два месяца.
Отдельная история — скриншоты. Интерфейсы меняются чаще документации, и картинка в статье почти всегда старше текста. Ориентироваться лучше на смысл шага, а не на расположение кнопок.
Тот же подход применим и к материалу, который вы читаете. Дата проверки указана в конце, первоисточники названы по ходу: если вы открыли статью через полгода, начните с документации Google и сверьте цифры сами.
Кому модель подходит, а кому нет
Генеративное видео закрывает не любую задачу, и трезвый расчёт экономит бюджет.
Подходит хорошо. Короткие рекламные вставки и заставки, где нужен эффектный проход камеры. Оживление товарных фотографий для карточек и витрин. Атмосферные врезки в блогерский монтаж. Раскадровка для съёмочной группы — вместо рисованных сториборд. Обучающие сцены, где говорящий человек проще сгенерировать, чем снять.
Подходит плохо. Всё, где важна фактическая точность: инструкции по работе с реальным оборудованием, медицина, юридические разъяснения. Материалы с узнаваемыми людьми и брендами — тут вопросы к правам. Длинные связные истории: удержать сюжет на десятках склеек генерация пока не позволяет.
Не подходит вовсе. Замена настоящей съёмки там, где зритель ждёт документальности. Синтетическая картинка считывается, и доверие к сообщению падает — особенно в отзывах и кейсах.
Практическое правило простое: чем короче фрагмент и чем меньше в нём конкретных фактов, тем выше шанс, что генерация сэкономит деньги. Чем длиннее и точнее должно быть высказывание, тем быстрее выгоднее снять.
Чего Veo не умеет
Ограничения честнее знать заранее — они экономят деньги на неудачных попытках.
Длинную сцену одним куском. Потолок восемь секунд, остальное собирается склейкой или продлением.
Точный текст в изображении. Надписи, логотипы, вывески модель рисует декоративными закорючками. Ставить текст надо потом, в редакторе.
Стабильность персонажа без референсов. Две попытки по одному описанию дадут двух разных людей. Помогают только референсные изображения, и то не идеально.
Сложную физику. Жидкости, отражения, руки в быстром движении, множество людей — типичные места, где картинка ломается. Чем больше объектов взаимодействуют, тем выше шанс артефакта.
Предсказуемость. Один и тот же промпт дважды даёт разный результат. Это свойство генеративных моделей вообще, а не дефект конкретной, и планировать работу нужно из расчёта нескольких попыток на один нужный дубль.
Veo, Sora и Kling: чем различаются на практике
Сравнивать AI-генераторы видео по маркетинговым характеристикам бессмысленно — они у всех похожи. Разница видна на конкретных задачах.
| Veo 3.1 | Kling | Sora | |
|---|---|---|---|
| Звук | свой, всегда включён | есть не во всех режимах | был свой |
| Сильная сторона | речь персонажей, работа со светом | движение и физика тела | сценарная связность |
| Статус | работает | работает | закрыта OpenAI |
Veo берите, когда в сцене кто-то говорит или когда важен свет: липсинк и освещение — её сильные места.
Kling — когда сложное движение: танец, спорт, работа руками. Модель заметно устойчивее в физике тела, и вариантов у неё в chad больше, чем у любой другой видеомодели.
Sora больше не вариант: OpenAI закрыла её в 2026 году, веб и приложения отключены. Мы разбирали историю отдельно — она хорошо показывает, почему в нише не стоит привязывать процесс к одной модели.
Если задача шире, есть общая подборка нейросетей для видео с разбором, что под какой сценарий подходит.
Частые вопросы
Работает ли Veo бесплатно?
У Google — нет. Бесплатного уровня нет ни у одного варианта поколения, любая генерация платная. В сервисах-агрегаторах обычно есть стартовый тестовый лимит, но именно тест, а не постоянный бесплатный доступ.
Чем тройка отличается от 3.1, если про неё столько написано?
Тем, что тройки больше нет — Google отключил её 30 июня 2026 года. Отличия обновления описаны выше: продление сцены, референсные изображения, переход между кадрами и звук во всех перечисленных режимах.
Можно ли использовать результат в рекламе?
Условия задаёт лицензия того сервиса, через который вы генерируете, и она меняется. Перед коммерческим применением проверяйте её в актуальной редакции, а не по чужой статье.
На каком языке писать промпт для Veo?
Модель понимает русский, но на английском результат стабильнее — обучающих данных с английскими описаниями кратно больше. Практичный компромисс: сцену описывать по-английски, реплики персонажей — на нужном языке.
Сколько ждать генерацию?
От пары минут; конкретное время зависит от нагрузки, выбранного варианта и разрешения. Fast заметно быстрее основного.
Что делать, если результат почти хороший, но с браком?
Не переписывайте промпт целиком. Меняйте по одному элементу за попытку — сначала движение камеры, потом свет, потом действие. Так вы понимаете, что именно повлияло, и не теряете удачно найденное.
Как попробовать, не разбираясь с зарубежными подписками?
Через сервис, где доступ уже настроен и оплата идёт в рублях. В chad поколение 3.1 доступно вместе с остальными видеомоделями — страница модели и тестовый лимит на старте позволяют посмотреть, подходит ли она под вашу задачу, до покупки пакета.
—
Характеристики, цены и состав поколения Veo проверены 26 августа 2026 года по документации Google и живому прайсу сервиса. В нише версии моделей меняются за недели — перед работой сверяйтесь с актуальными источниками.