← Все статьи
Новости10 мин чтения

Себестоимость одного ИИ-шортса в 2026: конвейер без Sora и без иллюзий

Sora закрывается, дешёвый тир Veo и Gemini опустился до $0,05–0,10 за секунду, а настоящую цену ролика определяют брак и правила YouTube, а не тариф за секунду

Обложка статьи: Себестоимость одного ИИ-шортса в 2026: конвейер без Sora и без иллюзий

Sora закрывается, дешёвый тир Veo и Gemini опустился до $0,05–0,10 за секунду, а настоящую цену ролика определяют брак и правила YouTube, а не тариф за секунду

26 апреля 2026 у Sora отключили веб-версию и приложение. 24 сентября OpenAI снимает и Videos API вместе со всеми пятью снапшотами модели — sora-2, sora-2-pro и три их датированные версии, — не назвав замену: об этом прямо сказано в странице депрекейшенов OpenAI. Двухэтапный характер закрытия подтверждает и независимый разбор The Decoder. Для тех, кто уже сегодня ищет «ролики ии» не как тему для статьи, а как ежедневную задачу — сценарий, кадр, голос, субтитры, публикация, — это значит одно: конвейер, собранный вокруг Sora полгода назад, дорабатывает последние два месяца.

Собирается он теперь вокруг Google. Секунда генерации в дешёвых тирах стоит $0,05–0,10, только считать по ней бюджет бессмысленно: дешёвая секунда почти никогда не равна годной, а платформа, где эти ролики публикуются, с июля прямо считает шаблонный конвейер поводом для демонетизации. Ниже — из чего фактически складывается цена одного 30-секундного ролика и почему коэффициент брака важнее выбора модели.

Платите в рублях за AI-модели без наценки на токены через provod.ai

Прайс за секунду, который никто не платит целиком

Официальный тариф Veo 3.1 за секунду готового видео со звуком выглядит так: Lite — $0,05 в 720p и $0,08 в 1080p, Fast — $0,10/$0,12/$0,30 (включая 4K), Standard — $0,40 за 720p и 1080p и $0,60 за 4K, согласно прайсу Gemini API. От Lite в 720p до Standard в 720p/1080p разброс восьмикратный, а если брать вместе с 4K за $0,60 — двенадцатикратный. В обоих случаях вывод один: выбор тира внутри семейства двигает бюджет сильнее, чем выбор вендора. При этом старые эндпоинты veo-2.0-generate-001 и оба veo-3.0 уже отключены 30 июня 2026 — миграция обязательна на 3.1, это зафиксировано в changelog Gemini API.

Параллельно 30 июня в публичное превью вышел Gemini Omni Flash: клипы 3–10 секунд, разговорная правка результата, токенная тарификация — $1,50 за миллион входных токенов и $17,50 за миллион выходных при фиксированной ставке 5792 токена на секунду видео, то есть около $0,10 за секунду, паритет с Veo 3.1 Fast. Руководитель developer relations Gemini API Logan Kilpatrick назвал это state-of-the-art редактированием по той же цене, что и генерация — цитата приведена в разборе eesel AI. В независимом слепом Elo-рейтинге Omni Flash действительно лидирует с результатом 1246 при $6,00 за минуту, обходя Dreamina Seedance 2.0 (1228, $9,07) и Wan2.7 (1164, $9,00) — данные Artificial Analysis. Но потолок в 10 секунд означает, что 30-секундный шортс распадается на три-четыре отдельные оплачиваемые генерации. И у Omni Flash Preview нет привычной для Gemini батч-скидки в 50%, а данные платного тира по условиям превью могут использоваться Google для улучшения продукта — это тоже из разбора eesel AI, и это меняет арифметику массовых ночных прогонов.

Годная секунда стоит в 3–5 раз дороже номинала

Вот здесь вендорская цифра расходится с полевой. Практик и автор DTF Виктория Ковдя зафиксировала: из 10 генераций в Kling AI публикации годны только 2–3, поэтому фактическая себестоимость выше номинальной цены секунды в 3–5 раз, а разброс цены одного клипа между сервисами достигает 96 крат — от $0,14 до $13,50, судя по её подсчёту на DTF. Измерение это одиночное, никем независимо не воспроизведённое: самозамер практика без опубликованной методики. Но именно он объясняет, почему в её же примере новичок при пяти попытках на ролик тратит $115 на 10 выпусков против $20–90 дохода.

Разница между рамкой Kilpatrick и рамкой Ковдя — это разница между «сколько стоит выход API» и «сколько стоит ролик, который можно опубликовать». Для бюджета решает второе.

Что реально уходит в 30-секундный ролик

02 evidence

Формула не сложная: секунды генерации × тариф тира × число дублей + липсинк + транскрипт + субтитры. Дубли — это и есть поле «коэффициент брака»: подставьте туда не 1, а 3–5, если модель ещё не доказала на вашем сценарии стабильно высокий процент годных генераций.

ШагТарифНоминал на ролик (~30–32 сек)С коэффициентом брака ×3–5
Видео (Omni Flash, 4 сегмента по 8 сек)$0,10/сек$3,20$9,60–16,00
Липсинк$0,02–0,133/сек$0,60–4,00$1,80–20,00
Транскрипт (gpt-4o-transcribe)$0,006/мин≈$0,003≈$0,003
Субтитры (Submagic, амортизация плана)$0,69–1,27 за ролик$0,69–1,27$0,69–1,27
Итого≈$4,5–8,5≈$12–37

Тарифы транскрипта и субтитров — из прайса OpenAI и прайса Submagic соответственно; ограничения липсинка — статичный кадр не обрабатывается, профильные ракурсы дают плохой результат, длинные ролики режутся на куски по 30–40 секунд с риском таймаута — прямо описаны в документации sync.so. Вендорский диапазон $1–5 за «сырой» ролик тоже сходится, но на другом наборе тиров: Veo 3.1 Lite за $0,05 в 720p, липсинк по нижней границе $0,02 за секунду и субтитры по цене плана Submagic Business + API ($69 за 100 роликов, то есть $0,69 за штуку) дают около $2,8 за 30 секунд без единого дубля. На стартовом плане ($19 за 15 роликов, то есть $1,27 за ролик) та же сборка стоит уже около $3,4 — выбор тарифа субтитров двигает итог примерно на пятую часть ещё до первого брака. Таблица выше считает дороже, потому что берёт Omni Flash по $0,10 и весь коридор липсинка вплоть до $0,133 за секунду. С учётом брака практика Ковдя оказывается ближе к правде в любом из двух сценариев.

Монетизация YouTube: удар по шаблону

Обновление политики монетизации от 16 июля 2026 не запрещает синтетическое видео. Оно детализирует три категории «неаутентичного контента»: шаблонное и повторяющееся, неприятное и шокирующее, ИИ-персоны по чувствительным темам — здоровье, право, финансы, политика — согласно политике монетизации YouTube. Глава trust and safety Matt Halprin прямо объяснил цель в Creator Insider: платформа не против того, что «можно делать много видео», а против того, что все они выглядят и звучат одинаково — комментарий приведён в материале TechCrunch. Порог «массовости» числом не задан, правоприменение непрозрачно — но канал, который держится на одном фиксированном шаблоне сцены и одном голосе, рискует доходом целиком.

Возражение практика: конвейер — это отдел, а не подписка

03 decision

Здесь появляется сильнейшее возражение всей этой арифметике. Цена секунды — самая маленькая и самая нестабильная часть себестоимости. Автор vc.ru Никита Красилов, строящий «контент-заводы» для бизнеса, называет ориентир регулярности — 15–20 роликов в день против 5 в неделю у конкурентов — и добавляет: «Один сотрудник просто не справится», поток держит отдел с ответственным на каждом этапе, а ИИ ускоряет отдельные шаги, оставляя цепочку на людях — из его разбора на vc.ru. Прибавьте риск демонетизации по политике inauthentic content и обрыв API — Sora через два месяца, veo-3.0 уже месяц как мёртв, — и экономия против съёмки перестаёт быть автоматической.

А экономия реальна: один Reels у фрилансера стоит 5 000–30 000 ₽, в пакетах продакшна — примерно 12 500–16 700 ₽ за ролик, по данным Raketa Digital. Даже верхняя граница ИИ-конвейера с браком — $37, то есть порядка 3300 ₽, если считать по грубому ориентиру 90 ₽ за доллар, — на порядок ниже. Разрыв не спорный. Спорно, кто закрывает разницу между «дешевле» и «дешевле при живом человеке, который отбирает 2–3 годных дубля из 10 и следит за политикой платформы».

Два маршрута оплаты и один нерешённый шаг

Практический выбор для автора из РФ упирается в два вопроса: через какой канал платить и кто отвечает за годность дубля. Вопрос «какая модель лучше» здесь второй. Прямой доступ к Veo и Omni Flash через официальные API даёт полный контроль над тирами и промптами, но требует карты для международных платежей и постоянного слежения за депрекейшенами — только в июне отключили три эндпоинта Veo. Рублёвый бот-посредник вроде Video SD Bot от KolerskyAI снимает вопрос оплаты — пакеты от 129 до 890 ₽ за 120–1000 кредитов, VEO-3 на 8 секунд за 80 кредитов, — но субтитры там вообще не заявлены, а права на результат на странице не раскрыты. Русская озвучка тем временем сузилась: SaluteSpeech с 15 июля 2026 закрыл продажу пакетов и Freemium для физлиц, согласно тарифам SaluteSpeech, а прайс ElevenLabs на дату этого разбора вообще не открылся — маршрут озвучки остаётся нерешённым шагом конвейера.

Для этапа, где сравнение моделей и стабильность оплаты важнее конкретного вендора, часть команд ведёт сценарный и текстовый слой через один OpenAI-совместимый API — например, provod.ai: существующий OpenAI-совместимый клиент подключается заменой base URL и ключа, а дальше модели каталога сравниваются в одном API, без отдельной интеграции под каждого провайдера. Когда объём выпуска дорастает до отдела, о котором говорит Красилов, вопрос смещается от цены секунды к тому, кто платит и по какому документу: оплата из России в provod.ai идёт рублями — российской картой, через СБП или по счёту, а бизнесу доступны договор и закрывающие документы от российского юрлица. Это снимает с бухгалтерии карту продакшн-агентства и крипто-прокладки для доступа к зарубежным API, но не отменяет ни выбора видеомодели, ни живого отбора годных дублей.

Рабочее правило на выходе одно: по умолчанию подставляйте в калькулятор коэффициент брака ×3–5 и держите его там, пока конкретная модель не докажет обратное на вашем собственном сценарии. Итог сильнее вендора двигают две настройки внутри сборки — тир видеомодели (от $0,05 у Veo 3.1 Lite до $0,40 у Standard за секунду) и план субтитров ($0,69 против $1,27 за ролик, около пятой части сборки ещё до первого дубля). В календаре стоит держать две даты: 24 сентября 2026, когда OpenAI снимает Videos API и все пять снапшотов Sora 2, и выход Omni Flash из preview — цена $0,10 за секунду и потолок в 10 секунд заявлены как превью-условия. К обеим датам конвейер придётся пересчитывать заново, и лучше заложить это в план выпуска сразу.

provod.ai — единый контур для растущего числа команд и сценариев

Добавляйте сотрудников, продукты и новые модели без отдельной закупки для каждого направления: общий API и рабочее пространство снижают операционный хаос по мере роста.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Рост использования не включает процент агрегатора поверх модели: провайдерская цена сохраняется 1:1, без собственной маржи provod.ai.

Подготовьте AI-контур к росту: форма регистрации · цены на модели · защита данных по 152-ФЗ · API и интеграции

Источники