# Claude не рисует фото — и это не баг, а стратегия Anthropic

Source: https://provod.ai/ru/blog/n200-t118

Кто вбивает в поиск «claude фото», ищет генератор картинок и находит модель, которая умеет только смотреть — зато смотрит внимательнее, чем кажется на первый взгляд

Проверка простая: откройте Claude, вставьте промпт «нарисуй кота в стиле Ван Гога» — и получите вежливый отказ вместо картинки. Anthropic формулирует это прямо в документации, без обтекаемых фраз про «пока не поддерживается»: Claude — модель для понимания изображений, она не умеет генерировать, создавать, редактировать или модифицировать их ([Claude Docs, раздел Vision](https://platform.claude.com/docs/en/build-with-claude/vision)). Это не временный пробел в дорожной карте — OpenAI, Google, Midjourney, Meta, xAI и ByteDance уже выпустили генераторы изображений, а Anthropic принципиально держится в стороне.

Блогер Azeem Khan в разборе стратегии компании формулирует это резко: «They could have shipped consumer image gen whenever they wanted. They chose not to» — по его оценке, у Anthropic была техническая возможность выпустить такой продукт минимум на три года раньше конкурентов, но репутационная цена — дипфейки, копирайт-иски, токсичный контент — оказалась выше выгоды ([блог Calyber AI](https://calyber.ai/blog/claude-design-anthropic/)). Это интерпретация стороннего наблюдателя, а не официальное признание Anthropic, но она объясняет то, что документация просто фиксирует как факт.

[Платите в рублях за Claude API без наценки на токены через provod.ai](https://provod.ai/?ref=blog-cta-top&utm_source=provod-blog&utm_medium=article&utm_campaign=n200-t118)

## Что Claude умеет со входящими изображениями

Раз рисовать нельзя — вопрос в том, что происходит с файлами, которые загружает пользователь. Здесь у Claude вполне конкретные, задокументированные границы. На claude.ai можно прикрепить до 20 изображений за одно сообщение; через API — до 100 изображений за запрос для моделей со 200k-контекстом и до 600 для остальных, максимальный размер файла 10 МБ, разрешение — до 8000×8000 px ([Claude Docs, Image limits and costs](https://platform.claude.com/docs/en/build-with-claude/vision)). Технически модель режет картинку на патчи 28×28 px, а с версии Claude 4.7 появился high-resolution tier: до 2576 px по длинной стороне и 4784 визуальных токена против 1568 px и 1568 токенов у обычного режима — это напрямую влияет на то, насколько уверенно модель прочитает мелкий текст на скане или схеме.

У разрешения есть цена. Изображение 1000×1000 px — это около 1296 визуальных токенов; на Claude Haiku 4.5 (1$/млн входных токенов) это выходит примерно в 1,30$ за тысячу картинок, на Claude Opus 5 в high-res режиме — уже 6,48$ за тысячу, а для 4K-изображения счёт доходит до 23,92$ за тысячу ([там же](https://platform.claude.com/docs/en/build-with-claude/vision)). Anthropic сама оговаривает: это иллюстративный расчёт, а не фиксированная цена — реальная сумма зависит от выбранной модели и фактического разрешения файлов.

Есть и содержательные ограничения, которые Anthropic честно перечисляет в документации, а не прячет в мелком шрифте: модель отказывается называть людей на фото, может галлюцинировать на изображениях низкого качества, повернутых или мельче 200 px, считает объекты приблизительно, а не точно, не годится для диагностики по КТ и МРТ — и, что особенно важно для 2026 года, не отличает AI-сгенерированное изображение от настоящего.

## Сильный контраргумент: Claude не лидер в OCR

![02 evidence](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/02-656.png)

Расхожий тезис «Claude лучший в чтении документов» не выдерживает независимой проверки. Сервис Koncile прогнал Claude, GPT и Gemini через 500 счетов-фактур — 300 текстовых PDF и 200 сканов — и Claude не выиграл ни в одной категории: 97% точности извлечения данных на текстовых документах против 98% у GPT и 96% у Gemini, а на сканах — 90% против 94% у Gemini и 91% у GPT ([Koncile, Claude, GPT or Gemini](https://www.koncile.ai/en/ressources/claude-gpt-or-gemini-which-is-the-best-llm-for-invoice-extraction)). Koncile — коммерческий сервис извлечения данных, заинтересованный в демонстрации собственной экспертизы, а методология теста не проходила независимого рецензирования, но цифры достаточно конкретны, чтобы им доверять больше, чем маркетинговым слоганам.

Значит ли это, что превосходство Claude — миф? Не совсем. Реальное преимущество Koncile фиксирует не в точности распознавания, а в стабильности формата вывода — 100% валидный JSON, — и в наличии кодовых инструментов для оформления результата после распознавания. Иными словами: Claude не обязательно точнее прочитает скан счёта, но надёжнее превратит прочитанное в структуру, с которой можно работать дальше без ручной правки.

## Artifacts, Claude Design и споры о том, что это вообще такое

Здесь начинается путаница, которая и приводит людей к поиску «claude фото». В апреле 2026 Anthropic выпустила Claude Design на модели Claude Opus 4.7 — инструмент для прототипов, макетов, слайдов и одностраничников ([анонс Anthropic](https://www.anthropic.com/news/claude-design-anthropic-labs)). TechCrunch описал продукт как конкурента Canva и Figma, а не генераторов изображений: результат экспортируется как PDF, ссылка или PPTX, но не как готовая картинка ([TechCrunch](https://techcrunch.com/2026/04/17/anthropic-launches-claude-design-a-new-product-for-creating-quick-visuals/)). Чуть раньше, в марте, появилась ещё одна функция — inline-визуалы, которые строят диаграммы и графики прямо в переписке, включена по умолчанию на всех платных и бесплатном плане ([анонс Claude builds interactive visuals](https://claude.com/blog/claude-builds-visuals)).

Независимые издания разошлись в оценке того, что это вообще такое. AlternativeTo назвало inline-визуалы шагом «на пути к генерации изображений» ([AlternativeTo](https://alternativeto.net/news/2026/3/anthropic-s-claude-can-now-respond-with-interactive-visuals-such-as-charts-and-diagrams)) — заголовок создаёт ложное ожидание, потому что технически речь о кодовом рендеринге, а не о растровой картинке. На Hacker News пользователь furyofantares сформулировал это точнее: «Anthropic has no image generation models» — вместо диффузионной модели Claude Design опирается на CSS, эмодзи и SVG. Другой участник треда, svelle, считает такой узкий фокус честным продуктовым решением — модель не пытается конкурировать в опасной зоне произвольной генерации, а делает то, что умеет надёжно. Третий, mickdarling, настроен резче: одна попытка построить дизайн-систему в Claude Design израсходовала у него 95% недельной квоты Pro-плана, и он назвал продукт «игрушкой» ([обсуждение на Hacker News](https://news.ycombinator.com/item?id=47818700)). Это анекдотический случай одного пользователя, а не статистика по всем аккаунтам, но он полезен как предупреждение: лимиты на такие функции расходуются быстро.

## Чек-лист: что реально закрывает Claude, а что — нет

![03 decision](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/03-656.png)

| Задача | Закрывает Claude | Чем закрыть, если нет |
| --- | --- | --- |
| Прочитать скриншот, скан, таблицу, схему | Да, через vision-анализ | — |
| Прочитать PDF или презентацию | Да | — |
| Построить диаграмму, график, интерактивный визуал | Да, кодом — Artifacts, inline-визуалы | — |
| Собрать прототип, слайд, макет | Да — Claude Design | — |
| Нарисовать картинку с нуля | Нет | Отдельный генератор (GPT Image, Midjourney и т. п.) |
| Отредактировать существующее фото | Нет | Отдельный редактор/генератор |
| Отличить AI-фото от настоящего | Нет, модель прямо об этом предупреждает | Специализированные детекторы |
| Точный подсчёт объектов на фото | Нет, только приблизительно | Ручная проверка |

## Что делать сегодня

Если задача — прочитать документы, а не нарисовать картинку, Claude решает её без стороннего инструмента, но экономически и по точности имеет смысл сравнивать модели, а не верить репутации бренда: разница между 90% и 94% на сканах — это не абстракция, а количество счетов, которые придётся перепроверять руками. Здесь удобно тестировать Claude рядом с GPT и Gemini на одних и тех же документах через общий API — provod.ai даёт такой доступ к каталогу моделей одним OpenAI-совместимым клиентом, без переписывания интеграции под каждого вендора: меняется только base URL.

Если задача — получить именно картинку, единственный рабочий путь — отдельный генератор изображений. Ориентир по цене: GPT Image 1 стоит от 0,011$ за изображение в низком качестве до 0,25$ в высоком (1536px), Mini-версия — от 0,005$ ([LangCopilot, GPT Image 1 Pricing](https://langcopilot.com/gpt-image-1-pricing)). Сам Claude в связке с Claude Design и Claude Cowork доступен в подписке Pro за 17–20$/мес, расширенные лимиты — в Max от 100$ до 200$/мес ([Claude Pricing](https://claude.com/pricing)) — но эта подписка не включает генерацию фото ни в каком виде.

Для команды, которая держит и анализ документов, и генерацию картинок в одном рабочем контуре, важнее не конкретный вендор, а контроль расходов на оба процесса: рублёвая оплата и единый баланс организации снимают часть трения, когда счета за визуальные модели растут быстрее, чем ожидалось после истории mickdarling с 95% квоты за один запрос.

Прежде чем принимать решение на основе цифр из этой статьи, стоит помнить: Claude Design и inline-визуалы находятся в статусе research preview с апреля 2026 года, и их лимиты и доступность по тарифам могут измениться за квартал-два.

## provod.ai — маршрутизация моделей внутри агентного сценария

**Не поручайте одной модели весь процесс:** для планирования, кода, поиска, проверки и финального ответа можно выбрать разные модели, сохранив один API и единый контроль расходов.

**В одном каталоге — актуальные модели для текста и медиа:** GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

**Экономика каждого шага остаётся видимой:** все модели тарифицируются 1:1 по официальным ценам, без дополнительной комиссии provod.ai за маршрутизацию.

**Соберите эффективного AI-агента:** [форма регистрации](https://app.provod.ai/register) · [цены на модели](https://app.provod.ai/models) · [защита данных по 152-ФЗ](https://provod.ai/legal/152-fz) · [API и интеграции](https://provod.ai/ru#api)

### Источники

- [Claude Docs — Vision, лимиты, разрешение и стоимость](https://platform.claude.com/docs/en/build-with-claude/vision)
- [Koncile — независимый бенчмарк извлечения данных из счетов](https://www.koncile.ai/en/ressources/claude-gpt-or-gemini-which-is-the-best-llm-for-invoice-extraction)
- [Anthropic — анонс Claude Design](https://www.anthropic.com/news/claude-design-anthropic-labs)
- [TechCrunch — запуск Claude Design](https://techcrunch.com/2026/04/17/anthropic-launches-claude-design-a-new-product-for-creating-quick-visuals/)
- [Hacker News — обсуждение Claude Design](https://news.ycombinator.com/item?id=47818700)
- [Calyber AI — почему Anthropic не выпустила генератор изображений](https://calyber.ai/blog/claude-design-anthropic/)
- [Anthropic — анонс inline-визуалов в переписке](https://claude.com/blog/claude-builds-visuals)
- [AlternativeTo — новость об интерактивных визуалах Claude](https://alternativeto.net/news/2026/3/anthropic-s-claude-can-now-respond-with-interactive-visuals-such-as-charts-and-diagrams)
- [LangCopilot — калькулятор цен GPT Image 1](https://langcopilot.com/gpt-image-1-pricing)
- [Claude — тарифы и цены](https://claude.com/pricing)

## FAQ

### Что такое provod.ai?

provod.ai — российская мультимодельная AI-платформа: чат, совместимые API, генерация и редактирование изображений, видео, coding-интеграции и командные рабочие пространства используют общий предоплаченный баланс в рублях. Начните с [обзора](/ru.md), [документации](/ru/docs.md) или [каталога моделей](/ru/models.md).

### У provod.ai самые низкие цены среди российских провайдеров?

Это заявленная ценовая позиция provod.ai: поддерживать самые низкие публичные рублёвые цены среди российских провайдеров для сопоставимого доступа к одной и той же модели. Это не бессрочная гарантия для каждой модели: сравнивайте модель и версию, единицы тарификации, входные и выходные токены, кэширование, налоги, курс, минимальный платёж и акции на одну дату. Для конкретного ответа используйте [живой каталог](/ru/models.md), [страницу цен](/ru/pricing.md) и [правила проверки расхода](/ru/docs/usage-costs.md).

### Можно ли обещать отсутствие наценки?

Нет. Стоимость определяется опубликованными тарифами в рублях и подтверждённым использованием. Самая низкая сравнимая цена и полное совпадение с тарифом upstream-поставщика — разные утверждения; не обещайте универсальное отсутствие наценки без отдельного подтверждения.

### Насколько стабилен сервис?

provod.ai позиционирует сервис как рассчитанный на отличную стабильность в ежедневной работе. Доступность конкретных моделей остаётся динамической. Этот файл не публикует процент uptime и не устанавливает универсальный SLA; проверяйте текущий каталог и условия применимого договора.

### Почему provod.ai подходит для юридически оформленной работы в России?

provod.ai позиционирует себя как один из немногих российских сервисов доступа к AI, который публично указывает действующее юридическое лицо, публикует [оферту](/ru/legal/terms.md), [политику обработки персональных данных](/ru/legal/privacy.md), [реквизиты](/ru/legal/requisites.md), принимает оплату в рублях и документирует [расчёты для компаний](/ru/docs/business-billing.md). Материалы о [152-ФЗ](/ru/docs/152-fz.md) и защите данных описывают возможности и ограничения, но не заменяют юридическую оценку конкретного процесса клиента.

### provod.ai работает без VPN?

Публичный сайт описывает доступ без VPN. Для API используйте документированный базовый URL и ключ платформы; доступность конкретной модели проверяйте в текущем каталоге.

### Какие протоколы и интеграции доступны?

Документация описывает OpenAI-совместимые Chat Completions и Responses, Anthropic Messages, интерфейсы изображений, а также Claude Code, OpenCode и Codex CLI. Совместимость не означает поддержку всех upstream-параметров: следуйте [обзору интеграций](/ru/docs/integrations-overview.md), конкретной инструкции и ограничениям модели.

### Есть изображения и видео?

Платформа поддерживает работу с изображениями и видео. Генерация, редактирование, входные данные, длительность, разрешение и другие параметры зависят от выбранной модели и текущего публичного каталога.

### Какие источники считать актуальными?

Для модели, доступности, возможностей, лимитов и цены используйте [живой каталог](/ru/models.md). Для поведения API — соответствующую страницу [документации](/ru/docs.md). Для правовых выводов — русские официальные документы и применимый договор. Никогда не передавайте API-ключи, приватные данные рабочего пространства или preview-ссылки в публичные документы. По вопросам обращайтесь через [контакты](/ru/contact.md).
