LTX-2.5 — открытая мировая модель с ускорением NVIDIA: весь видеопроизводственный стек теперь помещается на одном рабочем столе
LTX-2.5 даёт создателям контента то, что раньше было доступно только за дверями профессиональной студии: по-настоящему стабильную согласованность. Нативная многокадровая генерация (multishot) воспроизводит целую последовательность как единый согласованный фрагмент, удерживая облик персонажа от кадра к кадру и устраняя те «глюки», которые делали ранние открытые модели непригодными для рекламных кампаний. В паре с более мощной языковой основой Gemma 4 и новым декодером, снижающим артефакты в сценах с интенсивным движением, результат оказывается почти готовым к пост-продакшену. Всё это работает на потребительской видеокарте NVIDIA RTX, прямо внутри ComfyUI. Один человек за столом может зафиксировать фирменного персонажа или узнаваемый стиль с помощью быстрой LoRA-дообучения. Никакой студии, никакого облака, никакой утечки интеллектуальной собственности за пределы машины.
Именно в этом и состоит настоящий сдвиг: весь производственный конвейер теперь умещается на одном десктопе. То, что раньше требовало команды, съёмочного дня, рендер-фермы и внушительного облачного счёта, теперь происходит на RTX-карте, которая уже стоит в компьютере. Дополнительные клипы не несут платы за генерацию, не расходуют метризованные кредиты. Это меняет саму логику работы: можно экспериментировать широко, пробовать десяток направлений вместо того, чтобы ставить всё на одну «безопасную» идею, и позволять GPU за ночь генерировать недельный объём контента. Просыпаешься — а в папке уже целый набор готовых вариантов.
Для авторов коротких форматов и рекламных команд, работающих в режиме постоянного обновления, это настоящая трансформация. Усталость от рекламы обычно наступает в течение 7–10 дней, так что узким местом никогда не были идеи — им не хватало стоимости и времени на производство достаточного объёма. Локальная генерация устраняет это ограничение: можно плодить вариации на один и тот же бриф, тестировать десять хуков, локализовать материал для пяти рынков и обновлять креатив до наступления «усталости». Сольные авторы и небольшие команды теперь способны сравниться по объёму выпуска с полноценной студией, имея одну RTX-видеокарту на столе.
Впрочем, всё это не имело бы значения, если бы генерация была медленной. Но она быстрая. В опубликованном LTX бенчмарке image-to-video 10-секундный клип занимает 6,8 секунды локально на 2x NVIDIA GB200 и 23,7 секунды через LTX API. Самые быстрые закрытые альтернативы — Omni Flash, Grok 1.5 и Veo 3.1 — укладываются в 52–70 секунд. Медленные системы уходят далеко за эти рамки: Seedance 2.0 — 196 секунд, FLUX 3 — 259, Seedance 2.5 — 317, а Kling 3.0 Pro — 398. Локально LTX-2.5 генерирует быстрее, чем длится сам клип: в 7,6 раза быстрее ближайшей закрытой альтернативы и примерно в 58 раз быстрее самой медленной. Такой разрыв делает ночную пакетную генерацию и быстрые A/B-итерации практичными, а не теоретическими.
Весь август NVIDIA подсвечивает модели, приложения и инструменты локальной ИИ-экосистемы. Nemotron 3.5 Lightning, также вышедшая сегодня, — это открытая 30B-модель смеси экспертов для постоянно включённых агентов, в паре с NeMo Switchyard — библиотекой с открытым исходным кодом, которая маршрутизирует каждый шаг агентского рабочего процесса к наиболее подходящей модели. Общая нить здесь — свобода выбора железа: открытые модели экосистемы NVIDIA масштабируются от RTX-ПК до рабочих станций, дата-центров и облака. LTX-2.5 вписывается в эту историю как мировая модель с ускорением NVIDIA для создателей, разработчиков и робототехнических команд.
Если большие языковые модели (LLM) учатся предсказывать следующее слово, то мировые модели учатся предсказывать следующий момент. Они генерируют окружения, симулируют их поведение и позволяют пользователям действовать внутри них. Такая основа поддерживает кино, рекламу, игры, симуляции и роботов на складах и фабриках. LTX называет семейство LTX самой используемой открытой мировой моделью — более 33 миллионов загрузок — и позиционирует LTX-2.5 как самый capable релиз в линейке. Открытые веса дают командам полный контроль над оборудованием, кастомизацией и интеллектуальной собственностью.
LTX-2.5 поставляется с открытыми весами на Hugging Face, нативно интегрирована в ComfyUI и доступна через LTX API для управляемой генерации. Она работает на чём угодно — от дата-центровых GPU до Mac — и бесплатна для организаций с годовой выручкой ниже 10 миллионов долларов. Код опубликован на GitHub вместе с документацией.
По материалам MarkTechPost
