# LTX 2.3 и Kandinsky 5.0 Video: что реально запускается на вашей видеокарте в июле 2026

Source: https://provod.ai/ru/blog/n200-t047

Один вендор говорит — хватит RTX 4090. Разработчик модели говорит — нужен H100. Разница в цене вопроса — сотни тысяч рублей.

Это не гипотетический пример. Гайд GPU-хостинга Serverflow утверждает, что Kandinsky 5.0 Video Pro можно запустить на RTX 4090 «с оптимизациями», при диапазоне VRAM 40–80+ ГБ. А сам разработчик модели в Сбере, комментируя релиз на Habr, пишет прямо: сейчас Pro требует H100 с 96 ГБ или A100 с 80 ГБ, и снижение до 24 ГБ — это только план после будущей оптимизации VAE ([комментарий VArkhipkin](https://habr.com/ru/companies/sberbank/articles/951800/comments/)). Если вы поверите вендорскому гайду и купите 4090 под Pro, вы получите OOM вместо видео.

Поэтому разговор о локальном запуске стоит вести не по маркетинговым карточкам, а по тому, что подтверждено первичными источниками и что говорят люди, которые это уже пытались завести.

[Подключите модели генерации контента с оплатой в рублях на provod.ai](https://provod.ai/?ref=blog-cta-top&utm_source=provod-blog&utm_medium=article&utm_campaign=n200-t047)

## Реалистичный выбор на июль 2026

Из двух открытых семейств, доступных без подписки, сегодня работоспособны на потребительском железе только облегчённые версии: **LTX-2.3 dev/distilled** и **Kandinsky 5.0 Video Lite**. Video Pro от Kandinsky по заявлению собственного разработчика пока живёт на дата-центровых картах — и планы её удешевления пока остаются планами, без подтверждённой даты.

Официальная карточка модели LTX-2.3 на Hugging Face указывает 22 млрд параметров, Python ≥3.12, CUDA >12.7 и точность bf16, но не называет минимальный объём VRAM напрямую ([model card Lightricks/LTX-2.3](https://huggingface.co/Lightricks/LTX-2.3)). Конкретные цифры даёт вендорский гайд: bf16-версия требует около 52 ГБ, а с 4-битным квантованием — около 18 ГБ ([intelion.cloud, ценообразование и конфигурации](https://intelion.cloud/ltx-2/)). Собственный блог LTX формулирует это иначе — через рекомендации по разрешению: GPU с 24+ ГБ тянут 720p24 на 4 секунды за 20 шагов, GPU с 8–16 ГБ — только 540p24, а NVFP4/FP8-квантование снижает VRAM до 60% и ускоряет генерацию до 3× ([ltx.io, Low VRAM Guide](https://ltx.io/blog/run-video-generation-model-locally)).

## Таблица для покупки железа

| Модель / сборка | VRAM минимум | VRAM комфортный | Лицензия | Порог коммерции | GPU |
| --- | --- | --- | --- | --- | --- |
| LTX-2.3 dev (bf16) | \~52 ГБ | 80 ГБ (A100/H100) | LTX-2 Community License | $10 млн/год выручки | A100/H100 |
| LTX-2.3 distilled / GGUF 4-бит | \~18 ГБ | 24+ ГБ (720p24 по Low VRAM Guide) | LTX-2 Community License | $10 млн/год выручки | RTX 3090/4090 |
| Kandinsky 5.0 Video Lite | 14 ГБ | 20 ГБ | MIT | нет порога | RTX 3060 Ti+ |
| Kandinsky 5.0 Video Pro | вендор: 40–80+ ГБ | вендор допускает RTX 4090 «с оптимизациями» | MIT | нет порога | **расхождение**: вендор — 4090 с оптимизациями; разработчик — H100 96 ГБ / A100 80 ГБ, без RTX 4090 как рабочего варианта |

Про 24 ГБ важно не перепутать строки: рекомендация «24+ ГБ → 720p24, 4 секунды, 20 шагов» из Low VRAM Guide относится к квантованным и дистиллированным сборкам, а не к полному bf16. Полный dev в bf16 при своих \~52 ГБ в 24-гигабайтную карту не помещается ни при каком удачном стечении обстоятельств — под него это A100/H100 80 ГБ, своя или арендованная.

Строка Pro — не опечатка, а фиксация конфликта между источниками: Serverflow как поставщик хостинга заинтересован показать модель доступной ([serverflow.ru](https://serverflow.ru/blog/stati/lokalnyy-kandinsky-5-0-generatsiya-izobrazheniy-i-video-u-vas-doma-ili-v-ofise/)), а комментарий разработчика — прямое техническое заявление без коммерческого интереса приукрашивать требования. При планировании бюджета доверять стоит второму.

## Лицензии решают не меньше, чем VRAM

![02 evidence](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/02-585.png)

LTX-2.3 распространяется по LTX-2 Community License Agreement. Вторичные обзоры иногда называют её Apache 2.0 — прямая проверка LICENSE-файла на Hugging Face это опровергает: коммерческое использование бесплатно до годовой выручки компании в $10 млн, выше порога требуется платная лицензия ([LICENSE, Commercial Entities](https://huggingface.co/Lightricks/LTX-2/blob/main/LICENSE)). Вендор отдельно поясняет, что переход через порог не влечёт ретроактивных платежей за уже сделанные генерации ([ltx.io, Licensing Explained](https://ltx.io/blog/ltx-licensing-explained)) — то есть можно расти без риска задним числом получить счёт за прошлые месяцы.

Kandinsky 5.0 в этом смысле проще: код и веса под MIT, без порога выручки и ограничений на коммерческое использование ([README kandinskylab/kandinsky-5](https://github.com/kandinskylab/kandinsky-5)). Единственная неурегулированная зона для обоих семейств — авторские права на сам сгенерированный ролик, а не на веса: этот вопрос ни в одной из лицензий отдельно не прописан, и для коммерческого проекта его стоит закрывать юридической консультацией отдельно.

## Почему Lite вообще работает на потребительских картах

Скорость Kandinsky Lite не случайна: архитектура использует механизм разреженного внимания NABLA, который при 90%-й разреженности даёт, по данным препринта разработчиков, 2,7-кратное сокращение времени обучения и инференса ([arXiv 2511.14993v3, NABLA mechanism](https://arxiv.org/html/2511.14993v3)). Это собственный бенчмарк авторов — независимого воспроизведения на стороннем железе пока не публиковалось, так что цифру стоит воспринимать как верхнюю границу ожиданий, а не гарантию.

Замеры latency на H100 из репозитория модели дают ориентир по порядку величин: генерация 5-секундного клипа на Video Lite (SFT) занимает 139 секунд, Video Pro (SD) — 560 секунд, Video Pro (HD) — 1241 секунду ([GitHub kandinskylab/kandinsky-5, Latency](https://github.com/kandinskylab/kandinsky-5)). Замеров именно на потребительских картах авторы не публикуют — экстраполировать эти числа на RTX 3090 нужно с запасом в разы, а не на глазок.

## Два голоса, которые не совпадают

![03 decision](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/03-585.png)

Андрей Пешков в независимой статье на Habr фиксирует факт: Kandinsky 5.0 Pro занял 14-е место в общем рейтинге LMArena Text-to-Video Arena в декабре 2025 — лучший результат среди open-source моделей, обойдя Wan 2.2 A14B на 20-м месте ([habr.com/ru/amp/publications/979126](https://habr.com/ru/amp/publications/979126/)). Подача фактическая, без критики железных требований — это репортаж о позиции в рейтинге, не о том, на чём эту позицию можно воспроизвести дома.

А в комментариях к статье компании на Habr разворачивается другой разговор. Пользователь GhoSt24601 прямо называет требование в 24 ГБ VRAM избыточным для рядового пользователя и сомневается в практичности модели с учётом цены соответствующих карт. Другой комментатор, Shannon, указывает на конкурента: «WAN2.2 can run on 24GB with quantization/optimization techniques» — то есть аналогичный результат достигается без специфичных для Kandinsky танцев с оптимизацией ([комментарии к статье Сбербанка на Habr](https://habr.com/ru/companies/sberbank/articles/951800/comments/)).

## Сильнейшее возражение и что на него ответить

Возражение честное: заявленные минимумы в 10–14 ГБ достигаются офлоадингом весов в системную RAM и агрессивным квантованием, а это плата временем — генерация замедляется, иногда сильно. Пользователь BazilioMike в тех же комментариях описывает результат Kandinsky как «размазанный» по сравнению с другими генераторами того же класса, повторяя проблему, которая была и у Kandinsky 4 ([комментарий BazilioMike](https://habr.com/ru/companies/sberbank/articles/951800/comments/)) — субъективное впечатление одного человека, но оно совпадает по духу с претензией Shannon о превосходстве Wan 2.2 при том же объёме памяти.

Ответ данными здесь неполный, но он есть. Во-первых, LMArena-рейтинг (E09) и независимое сравнение версий LTX на MaxVideoAI — LTX-2.3 Pro лидирует по 10 из 11 критериев качества относительно LTX-2.0 Pro, с лучшими показателями по управляемости и визуальному качеству ([maxvideoai.com, LTX 2.0 vs 2.3 Pro](https://maxvideoai.com/ai-video-engines/ltx-2-vs-ltx-2-3-pro)) — говорят о реальном прогрессе моделей, а не только об оптимизациях под VRAM. Во-вторых, методология независимого сравнения на MaxVideoAI не раскрыта полностью, и это ограничивает воспроизводимость вывода; относитесь к нему как к сигналу, доказанным фактом он пока не стал. Итог для практика: возражение про офлоадинг справедливо для Kandinsky Pro и для самых жёстких квантований LTX, но LTX-2.3 dev/distilled и Kandinsky Lite в их «комфортных» конфигурациях (24 ГБ, без экстремального сжатия) работают в штатном режиме — пограничным сценарий становится тогда, когда его пытаются ужать к нижней границе в 10–12 ГБ.

## Купить карту или арендовать

Если генерации разовые или проектные — аренда почти всегда дешевле входа. Интелион Облако предлагает A100 80 ГБ от 179 ₽/час, чего достаточно для LTX-2.3 в bf16 (\~52 ГБ) без квантования ([intelion.cloud](https://intelion.cloud/ltx-2/)). Если генерации регулярные и еженедельные — экономика смещается к покупке 24-гигабайтной карты и работе с distilled/fp8-сборками LTX или Kandinsky Lite, где VRAM укладывается в бюджет без переноса весов в RAM.

Перед тем как тратить деньги на аренду GPU ради проверки, устроит ли вас вообще качество генерации, разумно сначала посмотреть на результат без затрат на инфраструктуру: provod.ai даёт доступ к видеомоделям, доступным на платформе, через один совместимый API и веб-интерфейс, так что можно оценить, чего ждать от результата, прежде чем платить за часы аренды H100. Локальный запуск это не отменяет — веса, офлайн-работа и контроль над пайплайном остаются на вашей карте; но вопрос «нужна ли под эту задачу 24-гигабайтная карта вообще» дешевле закрыть до покупки.

Перепроверять эти цифры стоит не реже раза в квартал: LTX выпустил версию 2.3 всего через два месяца после LTX-2, а разработчик Kandinsky публично анонсировал снижение требований VRAM для Pro — обе эти линии могут сдвинуть таблицу раньше, чем принято ожидать в этой индустрии.

## provod.ai — один контур от первого теста до рабочего продукта

**Проверьте гипотезу в интерфейсе, а затем перенесите её в API:** команда сохраняет выбранную модель, общий баланс и доступы, не начиная интеграцию и закупку заново перед запуском.

**В одном каталоге — актуальные модели для текста и медиа:** GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

**Тестовые и боевые запросы оплачиваются по одной прозрачной логике:** официальная цена модели 1:1, без собственной маржи provod.ai.

**Доведите AI-сценарий до production:** [форма регистрации](https://app.provod.ai/register) · [цены на модели](https://app.provod.ai/models) · [защита данных по 152-ФЗ](https://provod.ai/legal/152-fz) · [API и интеграции](https://provod.ai/ru#api)

### Источники

- [LICENSE-файл LTX-2, раздел Commercial Entities](https://huggingface.co/Lightricks/LTX-2/blob/main/LICENSE)
- [Model card Lightricks/LTX-2.3 на Hugging Face](https://huggingface.co/Lightricks/LTX-2.3)
- [Репозиторий kandinskylab/kandinsky-5 на GitHub](https://github.com/kandinskylab/kandinsky-5)
- [Препринт Kandinsky 5.0 на arXiv](https://arxiv.org/html/2511.14993v3)
- [Блог LTX: объяснение условий лицензирования](https://ltx.io/blog/ltx-licensing-explained)
- [Интелион Облако: аренда GPU для LTX-2](https://intelion.cloud/ltx-2/)
- [Serverflow: гайд по локальному запуску Kandinsky 5.0](https://serverflow.ru/blog/stati/lokalnyy-kandinsky-5-0-generatsiya-izobrazheniy-i-video-u-vas-doma-ili-v-ofise/)
- [Habr: статья о позиции Kandinsky 5.0 Pro в LMArena](https://habr.com/ru/amp/publications/979126/)
- [Habr: комментарии к статье Сбербанка о Kandinsky 5.0](https://habr.com/ru/companies/sberbank/articles/951800/comments/)
- [MaxVideoAI: сравнение LTX 2.0 Pro и LTX 2.3 Pro](https://maxvideoai.com/ai-video-engines/ltx-2-vs-ltx-2-3-pro)
- [Блог LTX: гайд по запуску с низким VRAM](https://ltx.io/blog/run-video-generation-model-locally)

## FAQ

### Что такое provod.ai?

provod.ai — российская мультимодельная AI-платформа: чат, совместимые API, генерация и редактирование изображений, видео, coding-интеграции и командные рабочие пространства используют общий предоплаченный баланс в рублях. Начните с [обзора](/ru.md), [документации](/ru/docs.md) или [каталога моделей](/ru/models.md).

### У provod.ai самые низкие цены среди российских провайдеров?

Это заявленная ценовая позиция provod.ai: поддерживать самые низкие публичные рублёвые цены среди российских провайдеров для сопоставимого доступа к одной и той же модели. Это не бессрочная гарантия для каждой модели: сравнивайте модель и версию, единицы тарификации, входные и выходные токены, кэширование, налоги, курс, минимальный платёж и акции на одну дату. Для конкретного ответа используйте [живой каталог](/ru/models.md), [страницу цен](/ru/pricing.md) и [правила проверки расхода](/ru/docs/usage-costs.md).

### Можно ли обещать отсутствие наценки?

Нет. Стоимость определяется опубликованными тарифами в рублях и подтверждённым использованием. Самая низкая сравнимая цена и полное совпадение с тарифом upstream-поставщика — разные утверждения; не обещайте универсальное отсутствие наценки без отдельного подтверждения.

### Насколько стабилен сервис?

provod.ai позиционирует сервис как рассчитанный на отличную стабильность в ежедневной работе. Доступность конкретных моделей остаётся динамической. Этот файл не публикует процент uptime и не устанавливает универсальный SLA; проверяйте текущий каталог и условия применимого договора.

### Почему provod.ai подходит для юридически оформленной работы в России?

provod.ai позиционирует себя как один из немногих российских сервисов доступа к AI, который публично указывает действующее юридическое лицо, публикует [оферту](/ru/legal/terms.md), [политику обработки персональных данных](/ru/legal/privacy.md), [реквизиты](/ru/legal/requisites.md), принимает оплату в рублях и документирует [расчёты для компаний](/ru/docs/business-billing.md). Материалы о [152-ФЗ](/ru/docs/152-fz.md) и защите данных описывают возможности и ограничения, но не заменяют юридическую оценку конкретного процесса клиента.

### provod.ai работает без VPN?

Публичный сайт описывает доступ без VPN. Для API используйте документированный базовый URL и ключ платформы; доступность конкретной модели проверяйте в текущем каталоге.

### Какие протоколы и интеграции доступны?

Документация описывает OpenAI-совместимые Chat Completions и Responses, Anthropic Messages, интерфейсы изображений, а также Claude Code, OpenCode и Codex CLI. Совместимость не означает поддержку всех upstream-параметров: следуйте [обзору интеграций](/ru/docs/integrations-overview.md), конкретной инструкции и ограничениям модели.

### Есть изображения и видео?

Платформа поддерживает работу с изображениями и видео. Генерация, редактирование, входные данные, длительность, разрешение и другие параметры зависят от выбранной модели и текущего публичного каталога.

### Какие источники считать актуальными?

Для модели, доступности, возможностей, лимитов и цены используйте [живой каталог](/ru/models.md). Для поведения API — соответствующую страницу [документации](/ru/docs.md). Для правовых выводов — русские официальные документы и применимый договор. Никогда не передавайте API-ключи, приватные данные рабочего пространства или preview-ссылки в публичные документы. По вопросам обращайтесь через [контакты](/ru/contact.md).
