Как начать пользоваться Vidu: AI-генератор видео из текста и фото
Полный гайд по Vidu -- китайскому AI-сервису для создания видео. Бесплатный тариф, три режима генерации: из текста, из фото и по референсу. Никакой установки -- работает в браузере.
Что это и для кого
Vidu -- это AI-сервис для генерации коротких видеороликов по текстовому описанию или фотографии. Разработан китайской компанией Shengshu Technology (студия из Пекина, основана в 2023 году) и работает на собственной диффузной видеомодели U-ViT. Агентство Bloomberg упоминало Vidu наряду с Kling AI и Runway как одну из платформ, которые заполняют нишу, освободившуюся после проблем с доступностью Sora от OpenAI.
Vidu подходит для нескольких категорий пользователей. Контент-мейкеры используют его для создания коротких роликов для Instagram Reels, TikTok и YouTube Shorts без необходимости снимать видео. Маркетологи и дизайнеры -- для анимации статичных изображений продукта и быстрого создания прототипов рекламных видео. Разработчики и исследователи -- для изучения возможностей AI-видео через API без значительных затрат на инфраструктуру. Наконец, все, кто хочет попробовать AI-генерацию видео бесплатно, оценят щедрый базовый тариф: 40 кредитов каждый месяц без привязки карты.
Главное технологическое преимущество Vidu перед большинством конкурентов -- так называемый мультиреференсный режим: загружаете несколько фотографий одного человека или объекта, и модель сохраняет их внешний вид на протяжении всего сгенерированного видео. Это решает ключевую боль AI-видеогенерации -- персонаж часто меняет внешность от кадра к кадру. В Vidu этой проблемы значительно меньше благодаря дополнительному пространству условий в архитектуре U-ViT.
По данным самой компании, сервис обрабатывает миллионы запросов в месяц от пользователей из более чем 100 стран. Скорость генерации -- от 10 секунд до нескольких минут в зависимости от загрузки серверов и выбранного качества. В пиковые часы азиатского рабочего дня очередь может быть длиннее -- пользователи из России замечали это около 9-11 утра по московскому времени (что соответствует дневному времени в Китае).
Как зарегистрироваться / установить
Vidu -- это веб-сервис, устанавливать ничего не нужно. Всё работает в браузере по адресу vidu.com. Поддерживаются Chrome, Firefox, Edge и Safari. Мобильное приложение для Android доступно в Google Play как Vidu -- AI Video Generator. Версия для iOS находилась в ограниченном бета-доступе на момент написания этого материала.
Чтобы зарегистрироваться, откройте vidu.com и нажмите кнопку Try Vidu в правом верхнем углу. Сервис предложит войти через аккаунт Google или зарегистрироваться по email. Авторизация через Google занимает несколько секунд -- никаких форм заполнять не нужно, сервис получит имя и email из вашего Google-аккаунта. Если предпочитаете email, введите адрес, придумайте пароль, подтвердите адрес по ссылке из письма.
Российский номер телефона, паспорт, адрес проживания и другие документы не требуются -- достаточно любого действующего email или Google-аккаунта. Это отличает Vidu от части западных сервисов, где могут просить верификацию через SMS.
После входа вы окажетесь в основном интерфейсе генерации. В центре -- поле для ввода промпта. Слева -- навигация по режимам: Text to Video, Image to Video, Reference to Video. Справа вверху -- счётчик оставшихся кредитов. Новым пользователям начисляется 40 кредитов немедленно, без ожидания. Кредиты обновляются в начале каждого календарного месяца.
Настройте интерфейс под себя: в правом нижнем углу поля ввода есть иконки для выбора соотношения сторон (16:9, 9:16, 1:1), длительности клипа (4 или 8 секунд на бесплатном тарифе) и стиля (Realistic, Anime, 3D Animation). Выберите параметры перед тем, как нажимать кнопку Create.
Первый запуск -- что попробовать
Начните с простого режима Text to Video. Введите описание на английском языке -- Vidu лучше понимает английские промпты, хотя базовые русские тоже работают. Пример хорошего промпта: «A tabby cat sitting on a windowsill, golden hour light, slow camera zoom out, cinematic style». Нажмите Create. Первая генерация займёт от 30 секунд до 3 минут.
Чтобы получить качественный результат с первого раза, структурируйте промпт по шаблону: субъект (кто или что) -- действие (что делает) -- окружение (где и когда) -- тип движения камеры (zoom, pan, dolly shot) -- настроение или стиль (cinematic, anime, realistic). Чем конкретнее описание, тем точнее видео. Абстрактные фразы вроде «beautiful nature» дают посредственный результат -- добавьте деталей: «misty mountain valley at sunrise, long grass swaying in wind, drone shot».
Полезные ключевые слова для промптов. Для кинематографического стиля: cinematic lighting, shallow depth of field, anamorphic lens. Для реалистичности: photorealistic, ultra-detailed, 8K. Для анимации движений камеры: slow dolly zoom, crane shot, tracking shot. Для настроения: golden hour, blue hour, dramatic shadows, soft diffused light.
После генерации вы увидите кнопки под готовым клипом. Download -- скачать файл MP4. Upscale -- улучшить качество до 4K (тратит дополнительные кредиты). Extend -- продлить видео ещё на несколько секунд. Regenerate -- сгенерировать заново с теми же настройками, если результат не понравился (тратит кредиты повторно). Share -- поделиться публичной ссылкой на видео.
Режим Image to Video -- следующий шаг для тех, кто уже попробовал текстовую генерацию. Загрузите любую фотографию (портрет, пейзаж, продуктовое фото) и опишите, какое движение должно появиться. Например, загрузите фото чашки кофе и напишите «steam rising from the coffee cup, background slightly blurring». Vidu анимирует статичное изображение -- это один из самых впечатляющих сценариев для маркетологов, потому что позволяет оживить уже существующие фотографии продуктов без повторной съёмки.
Режим Reference to Video наиболее уникален. Загрузите 2-5 фотографий одного человека или объекта с разных ракурсов, затем опишите желаемую сцену. Модель сохранит внешний вид этого персонажа на протяжении всего видео. Это полезно для создания промо-роликов с конкретным человеком или для брендинга -- когда нужно, чтобы логотип или упаковка продукта выглядели точно так же, как в исходных файлах.
Ключевые фишки
Мультиреференсный контроль -- главное технологическое отличие Vidu от большинства конкурентов. Загружая несколько исходных изображений, вы «обучаете» модель внешнему виду конкретного персонажа или продукта. Это особенно ценно для брендов: можно создавать видео, в которых упаковка или логотип выглядят точно так же, как в оригинале, а не с AI-искажениями, которые появляются у других генераторов.
Управление амплитудой движения. Ползунок Motion Amplitude перед генерацией позволяет задать интенсивность движения в клипе: от минимального (почти стоп-кадр с лёгким дуновением ветра или движением волос) до максимального (активная сцена с быстрым перемещением объектов и динамичной камерой). Для портретных видео и продуктовых съёмок рекомендуется ставить низкое значение -- это даёт более профессиональный, контролируемый результат.
Пресеты движения камеры. В интерфейсе можно указать тип движения: Static (статичная камера), Zoom In (приближение к объекту), Zoom Out (отдаление), Pan Left/Right (горизонтальное движение), Tilt Up/Down (вертикальное движение), Rotate (вращение). Это позволяет планировать кинематографические сцены без навыков режиссёра.
Режим Storyboard для платных пользователей. Функция позволяет создавать последовательность клипов с единой сюжетной линией: загружаете несколько кадров-ключей или текстовых описаний, и модель генерирует переходы между ними, сохраняя единый визуальный стиль и внешний вид персонажей. Это переводит Vidu из инструмента для генерации одиночных клипов в полноценный инструмент нарративного видеопроизводства.
Стили генерации. Перед созданием видео выбирайте предустановленный стиль: Realistic (фотореализм), Anime (японская анимация), 3D Animation (трёхмерный анимационный фильм), Cinematic (кинематографический стиль). Стиль влияет на весь облик видео и задаёт модели направление обработки деталей текстур, освещения и цветокоррекции.
API для разработчиков доступен через platform.vidu.com. Поддерживаются REST-запросы для всех трёх режимов генерации. Стоимость через API рассчитывается по секундам выходного видео и зависит от разрешения. Это позволяет интегрировать генерацию видео в собственные продукты: мобильные приложения, веб-сервисы, пайплайны для маркетинговых агентств.
Цены и ограничения
Бесплатный тариф включает 40 кредитов в месяц без привязки карты. Одна генерация стандартного 4-секундного видео при 720p тратит около 8-15 кредитов в зависимости от сложности сцены. На бесплатном тарифе доступна генерация видео длиной 4 секунды в разрешении 720p. Очередь обрабатывается в последнюю очередь относительно платных пользователей -- в часы пик ожидание может занимать 5-10 минут.
Платные тарифы разделены по объёму кредитов и дополнительным функциям. На момент написания актуальные цены и конкретные объёмы кредитов всегда указаны на странице vidu.com/pricing. Тарифы периодически обновляются по мере масштабирования сервиса. Разница между тарифами -- в длине клипа (до 15 секунд на старших тарифах), доступе к 4K-апскейлу, приоритете в очереди и доступе к функции Storyboard.
Начиная с Vidu Q3 (30 января 2026), Vidu генерирует нативное аудио вместе с видео в одном проходе: диалог, звуковые эффекты и музыка добавляются автоматически. Закадровый голос и дополнительное аудио можно также добавить в видеоредакторе (CapCut, DaVinci Resolve, Adobe Premiere) для тонкой настройки.
Права на контент: по условиям использования, видео, созданные на бесплатном тарифе, можно использовать в некоммерческих целях с указанием авторства Vidu. Коммерческое использование -- создание рекламных материалов, видео для клиентов, контент для монетизируемых каналов -- требует платной подписки. Перед коммерческим использованием всегда проверяйте актуальные условия в разделе Terms of Service на сайте, так как политика может обновляться.
Нужен ли VPN из России
На момент написания этого гайда Vidu работает в России без VPN. Сайт vidu.com открывается, регистрация через Google доступна без ограничений, генерация видео запускается и завершается без ошибок, связанных с геолокацией. Российские пользователи в тематических сообществах сообщают о стабильной работе сервиса в отличие от ряда американских аналогов.
Ситуация с оплатой сложнее. При попытке оформить платную подписку российскими банковскими картами (Visa, Mastercard, МИР) могут возникнуть проблемы -- большинство международных платёжных систем ограничивают транзакции для российских карт. Варианты решения: оплата через иностранную карту (если есть), использование сервисов-посредников для оформления виртуальных карт зарубежных банков, криптовалютная оплата если сервис поддерживает такой способ. Актуальные рабочие методы оплаты лучше уточнять в сообществах по AI-инструментам -- ситуация меняется.
Если сайт не открывается или загружается очень медленно -- включите VPN с серверами в США, Германии или Нидерландах. Бесплатные варианты VPN: ProtonVPN (бесплатный план, без ограничений по трафику), Windscale (10 ГБ/месяц). После подключения VPN откройте сайт в режиме инкогнито браузера -- это помогает избежать проблем с кешем. При использовании VPN качество видео и скорость генерации не меняются: обработка происходит на серверах Vidu, а не на вашем устройстве.
Мобильное приложение Vidu для Android (доступно в Google Play) может работать в России стабильнее веб-версии в случае проблем с доступом -- это отмечают пользователи в профильных Telegram-каналах. Если возникают проблемы с регистрацией через браузер, попробуйте установить приложение.
Vidu 2.0 и Multi-Entity Consistency: скорость генерации менее 10 секунд, стоимость около 4 центов за секунду видео (на момент написания). Функция Multi-Entity Consistency позволяет использовать от 3 до 7 референсных изображений для поддержания визуальной согласованности нескольких персонажей или объектов на протяжении всего видео.
Vidu Q3 (30 января 2026): нативная аудио-видео генерация в одном проходе. Длительность до 16 секунд, разрешение 1080p при 24 кадрах в секунду. Диалог, звуковые эффекты и фоновая музыка генерируются одновременно с видеорядом - без необходимости постобработки.
Vidu Q3 (12 июня 2026): обновление версии Q3, выпущенное 12 июня 2026 года. Ключевые нововведения: покадровый контроль камеры (frame-level camera control) -- пользователь может задавать параметры камеры для каждого кадра отдельно, а не только для клипа в целом; переходы между несколькими планами (multi-shot scene transitions) -- один запрос может включать несколько сменяющих друг друга ракурсов и планов с плавными переходами. Обновление укрепляет позиции Vidu как инструмента для кинематографического сторителлинга, а не только одиночных клипов. Актуальные сведения об условиях доступа -- на vidu.com.
Vidu S1: интерактивное видео в реальном времени (3 июля 2026)
3 июля 2026 года Shengshu Technology выпустила Vidu S1 -- принципиально новый тип генерации. В отличие от Vidu Q2 (пакетная генерация клипов), S1 работает в реальном времени: пользователь голосом управляет движениями AI-аватара во время генерации. Технические характеристики: разрешение 540p, 25--42 кадра в секунду. Один референсный снимок позволяет создать персонажа и взаимодействовать с ним неограниченное число раз. S1 работает на потребительских GPU (consumer GPU), не требуя специализированной серверной инфраструктуры. Основные целевые сценарии: прямые трансляции (livestreaming), игровые приложения и XR-среды (расширенная реальность).
Vidu 2.0: пакетная генерация
Vidu 2.0 поддерживает пакетную генерацию (batch generation): можно отправить несколько заданий одновременно и получить результаты параллельно, не дожидаясь завершения каждого клипа по очереди. Это особенно удобно при работе с вариациями одного и того же сценария – например, тестировании разных стилей или ракурсов для одного продукта. Для доступа к batch API используйте официальную документацию vidu.com/api.
Story Grid: инструмент для раскадровки
Vidu запустил Story Grid -- инструмент для предпродакшн-планирования, доступный по адресу vidu.com/create/story-grid. В отличие от режима Storyboard, ориентированного на генерацию видеопоследовательностей, Story Grid заточен под этап раскадровки: сначала выстраивается визуальный план проекта, затем он конвертируется в черновое видео. Разработчики описывают его как первый инструмент подобного типа на рынке.
Принцип работы: загрузите до 9 референсных изображений (персонажи, локации, ключевые объекты) и выберите формат сетки -- 4, 6, 9, 12 или 16 панелей. Модель генерирует многопанельный сторибординг-грид с сохранением внешнего вида персонажей и логикой развития сцен от кадра к кадру. Готовую раскадровку можно напрямую конвертировать в черновую видеопоследовательность внутри сервиса -- без экспорта во внешние редакторы.
Story Grid подходит режиссёрам музыкальных клипов, продюсерам рекламных роликов и контент-командам, которым нужно согласовать визуальную концепцию до начала производства. Инструмент доступен через основное меню Vidu наряду с генератором сценариев и другими инструментами предпродакшна.
Community Remix: совместное творчество
Community Remix -- инструмент совместного использования видео в Vidu. Пользователи могут брать публичные видео из открытой галереи платформы как основу и создавать собственные вариации: менять промпт, визуальный стиль, движение камеры или продолжительность. Это ускоряет обмен рабочими техниками: можно изучать популярные промпты других пользователей, проверять, как изменение одного параметра влияет на результат, и находить вдохновение для собственных проектов. Community Remix доступен через раздел Explore на vidu.com -- кнопка Remix появляется под любым публичным видео в галерее. Функция доступна на всех тарифах, включая бесплатный.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.
Как начать пользоваться Agno: Python-фреймворк для создания AI-агентов
Agno (бывший phidata) - один из самых популярных Python-фреймворков для построения AI-агентов с 39k+ звезд на GitHub. Пошаговый гайд: установка, первый агент за 5 минут, мультиагентные команды и деплой в продакшн.
Seedance 2.5: как начать пользоваться генератором видео от ByteDance
Seedance 2.5 от ByteDance генерирует нативное 30-секундное видео в один проход, принимает до 50 мультимодальных референсов и позволяет редактировать отдельные фрагменты без перегенерации всего клипа.
ChatGPT Work: как начать пользоваться агентным рабочим столом OpenAI
9 июля 2026 OpenAI запустила ChatGPT Work -- агента, который берёт у вас целый проект, сам планирует шаги, работает часами в фоне и возвращает готовый документ, таблицу или презентацию.