Запись архива

LTX-2.5: открытая world-модель для генерации видео запускается локально на NVIDIA RTX

LTX выпустила LTX-2.5 — открытую world-модель для генерации видео с нативным мультишотом и запуском на потребительских NVIDIA RTX и DGX Spark. Разбираем заявленную скорость, работу в ComfyUI и место релиза в августовской серии NVIDIA по локальному ИИ.

Генерация видео в интерфейсе ComfyUI на рабочей станции с NVIDIA RTX
Генерация видео в интерфейсе ComfyUI на рабочей станции с NVIDIA RTX
Kurdish people protest against the Turkiish government at Hay Hill, Norwich | by Roger Blackwell | openverse | by

11 августа компания LTX выпустила LTX-2.5 — открытую world-модель для генерации видео, оптимизированную для локального запуска на графических процессорах NVIDIA RTX и DGX Spark. В тот же день NVIDIA представила открытую агентную модель Nemotron 3.5 Lightning и библиотеку NeMo Switchyard. Вместе эти релизы показывают направление, в котором движется индустрия: open-weight модели, исполняемые локально, становятся рабочей инфраструктурой продакшена.

Что нового в LTX-2.5

В отличие от LLM, которые предсказывают следующее слово, world-модели предсказывают следующий момент видеоряда. Ключевая особенность LTX-2.5 — нативная мультишот-генерация: последовательность сцен создается как единое целое, а внешность персонажа сохраняется от кадра к кадру. Раньше именно «плавающая» внешность делала открытые модели непригодными для рекламных кампаний. Модель получила языковой бэкбон Gemma 4 и новый декодер, который, по заявлению LTX, уменьшает артефакты в сценах с быстрым движением. Отдельно компания отмечает снижение требований к видеопамяти — это одна из причин, по которой модель запускается на железе, уже имеющемся у создателей контента.

Локальный запуск и ComfyUI

LTX-2.5 работает на потребительских RTX, DGX Spark, серверных GPU и даже на Mac. Нативная интеграция с ComfyUI позволяет запускать генерацию без написания кода, а LoRA-файнтюнинг — закреплять фирменного персонажа или узнаваемый стиль на собственной машине. Для студий и агентств это означает, что исходный материал не покидает компьютер, а локальная генерация не тарифицируется за каждый клип, в отличие от облачных API. Меняется экономика рабочего процесса: вместо одного «безопасного» варианта можно генерировать десятки направлений и оставлять машину на ночной батч-рендер. С учетом того, что рекламная усталость аудитории наступает в среднем за 7–10 дней, скорость пересборки креативов становится конкурентным преимуществом небольших команд.

Заявленная скорость

Компания приводит собственный image-to-video бенчмарк: 10-секундный клип на двух NVIDIA GB200 генерируется за 6,8 секунды, через LTX API — за 23,7 секунды. Быстрые закрытые альтернативы — Omni Flash, Grok 1.5 и Veo 3.1 — занимают от 52 до 70 секунд. Еще медленнее, по данным LTX, Seedance 2.0 (196 секунд), FLUX 3 (259), Seedance 2.5 (317) и Kling

Datos clave

Punto Detalle
Fuente MarkTechPost
Fecha 2026-08-11T20:02:03+00:00
Tema The Video Production Stack Now Fits on One Desk: LTX-2.5 Launches as NVIDIA-Accelerated Open Weights World Model