[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"glossary-text-to-video::ru":3,"gloss-cluster-text-to-video::ru":20,"gloss-next-text-to-video::ru":61},{"slug":4,"category":5,"name":6,"definition":7,"meta_desc":8,"faq":9,"schema_markup":9,"related":10},"text-to-video","output","Text-to-Video (текст в видео)","Text-to-video — это категория генеративного ИИ, которая производит оригинальные видеоклипы — последовательности связных, движущихся кадров с согласованными объектами, освещением и движением камеры — прямо из текстового описания, без необходимости в исходных кадрах. Ведущие модели включают Sora от OpenAI, Veo от Google, Gen-3 Alpha от Runway, Pika Labs и Dream Machine от Luma; большинство из них используют диффузионные трансформеры, работающие с пространственно-временными латентами видео (сжатыми представлениями и пространства, и времени), а не с покадровой диффузией изображений, что и делает возможными правдоподобные панорамы камеры, постоянство объектов и приближённо-физичное движение на протяжении нескольких секунд. По состоянию на 2026 год большинство коммерческих инструментов text-to-video надёжно производят клипы длительностью 5-20 секунд с разрешением до 1080p, при этом более длинная или высокоразрешённая генерация всё ещё дорога и склонна к «дрейфу» (морфинг объектов, несогласованные фоны) тем сильнее, чем дольше длится клип, поэтому большинство коммерческих продуктов по умолчанию предлагают короткую длину клипа и предоставляют расширение\u002Fпродолжение как отдельную платную операцию, а не обещают произвольно длинную генерацию одним заходом. Почему это важно для создателей SaaS: text-to-video — самый быстрорастущий клин для ИИ-видеостартапов — генераторы рекламы для соцсетей, инструменты раскадровки\u002Fпредвизуализации для кинематографистов, генераторы B-roll для создателей контента и инструменты визуализации продукта, полностью пропускающие традиционные пайплайны CGI. Обычно потребляется через API с асинхронной семантикой задач, поскольку рендеринг занимает минуты, а не секунды. Конкретный разобранный пример — SaaS для рекламы в соцсетях, генерирующий B-roll для клиента: (1) приложение автоматически составляет видеопромпт из описания продукта клиента с помощью LLM, затем позволяет клиенту его уточнить: «Кинематографичный слоу-мо кадр открывающегося на мраморной поверхности матово-чёрного футляра для беспроводных наушников, мягкое студийное освещение, 4K, стиль предметной фотографии»; (2) отправляет промпт через `POST \u002Fv1\u002Fgenerate` с `duration=5, aspect_ratio=9:16` (для вертикальной рекламы) и выбранным параметром интенсивности движения (некоторые модели позволяют уменьшить движение камеры\u002Fобъекта, чтобы снизить вероятность видимых артефактов); (3) API немедленно возвращает `job_id`, а примерно через 2-5 минут срабатывает webhook с URL отрендеренного MP4, либо возвращается ошибка, если фильтры контентной политики отклонили промпт; (4) приложение автоматически компонует клип с наложением логотипа бренда и анимированными субтитрами, затем предлагает клиенту выбрать из 2-3 альтернативных дублей, сгенерированных из небольших вариаций промпта. Стоимость и время генерации круто растут с разрешением и длительностью — 5-секундный клип в 1080p может стоить значительно больше, чем сопоставимая генерация изображения, — поэтому большинство продуктов ограничивают пользователей бесплатного тарифа короткими превью низкого разрешения (например, 480p с водяным знаком) и закрывают более длинные клипы или экспорт высокого разрешения за платными кредитами, отражая то, как обычно монетизируются вычислительно затратные ИИ-функции.","Text-to-video создаёт оригинальные видеоклипы напрямую по текстовому промпту, без исходного видеоматериала.",null,[11,14,17],{"slug":12,"name":13},"image-generation","Генерация изображений",{"slug":15,"name":16},"lip-sync","Синхронизация губ (Lip Sync)",{"slug":18,"name":19},"video-synthesis","Синтез видео",[21,25,29,33,36,40,43,46,49,52,55,58],{"slug":22,"category":5,"name":23,"updated_at":24},"abstention","Отказ от ответа","2026-08-24T03:30:02+00:00",{"slug":26,"category":5,"name":27,"updated_at":28},"ai-copywriting","ИИ-копирайтинг","2026-08-24T02:46:38+00:00",{"slug":30,"category":5,"name":31,"updated_at":32},"ai-watermarking","Водяные знаки ИИ","2026-08-24T02:46:37+00:00",{"slug":34,"category":5,"name":35,"updated_at":32},"aspect-ratio-control","Управление соотношением сторон",{"slug":37,"category":5,"name":38,"updated_at":39},"audio-generation","Генерация звука (Audio Generation)","2026-08-24T02:46:36+00:00",{"slug":41,"category":5,"name":42,"updated_at":32},"audio-super-resolution","Аудио-суперразрешение",{"slug":44,"category":5,"name":45,"updated_at":39},"avatar-generation","Генерация аватара (Avatar Generation)",{"slug":47,"category":5,"name":48,"updated_at":39},"background-removal","Удаление фона (Background Removal)",{"slug":50,"category":5,"name":51,"updated_at":32},"batch-image-generation","Пакетная генерация изображений",{"slug":53,"category":5,"name":54,"updated_at":28},"brand-voice","Голос бренда",{"slug":56,"category":5,"name":57,"updated_at":28},"cfg-scale","CFG Scale (шкала classifier-free guidance)",{"slug":59,"category":5,"name":60,"updated_at":32},"character-consistency","Консистентность персонажа",{"pairs":62,"alternatives":70},[63,64,65,66,67,68,69],"airtable-vs-notion","bubble-vs-webflow","copy-ai-vs-jasper","framer-vs-webflow","frase-vs-surfer-seo","make-vs-zapier","jasper-vs-writesonic",[71,72,73,74,75,76],"copy-ai","jasper","webflow","bubble","zapier","airtable"]