← Все статьи
Новости8 мин чтения

Claude не рисует фото — и это не баг, а стратегия Anthropic

Кто вбивает в поиск «claude фото», ищет генератор картинок и находит модель, которая умеет только смотреть — зато смотрит внимательнее, чем кажется на первый взгляд

Обложка статьи: Claude не рисует фото — и это не баг, а стратегия Anthropic

Кто вбивает в поиск «claude фото», ищет генератор картинок и находит модель, которая умеет только смотреть — зато смотрит внимательнее, чем кажется на первый взгляд

Проверка простая: откройте Claude, вставьте промпт «нарисуй кота в стиле Ван Гога» — и получите вежливый отказ вместо картинки. Anthropic формулирует это прямо в документации, без обтекаемых фраз про «пока не поддерживается»: Claude — модель для понимания изображений, она не умеет генерировать, создавать, редактировать или модифицировать их (Claude Docs, раздел Vision). Это не временный пробел в дорожной карте — OpenAI, Google, Midjourney, Meta, xAI и ByteDance уже выпустили генераторы изображений, а Anthropic принципиально держится в стороне.

Блогер Azeem Khan в разборе стратегии компании формулирует это резко: «They could have shipped consumer image gen whenever they wanted. They chose not to» — по его оценке, у Anthropic была техническая возможность выпустить такой продукт минимум на три года раньше конкурентов, но репутационная цена — дипфейки, копирайт-иски, токсичный контент — оказалась выше выгоды (блог Calyber AI). Это интерпретация стороннего наблюдателя, а не официальное признание Anthropic, но она объясняет то, что документация просто фиксирует как факт.

Платите в рублях за Claude API без наценки на токены через provod.ai

Что Claude умеет со входящими изображениями

Раз рисовать нельзя — вопрос в том, что происходит с файлами, которые загружает пользователь. Здесь у Claude вполне конкретные, задокументированные границы. На claude.ai можно прикрепить до 20 изображений за одно сообщение; через API — до 100 изображений за запрос для моделей со 200k-контекстом и до 600 для остальных, максимальный размер файла 10 МБ, разрешение — до 8000×8000 px (Claude Docs, Image limits and costs). Технически модель режет картинку на патчи 28×28 px, а с версии Claude 4.7 появился high-resolution tier: до 2576 px по длинной стороне и 4784 визуальных токена против 1568 px и 1568 токенов у обычного режима — это напрямую влияет на то, насколько уверенно модель прочитает мелкий текст на скане или схеме.

У разрешения есть цена. Изображение 1000×1000 px — это около 1296 визуальных токенов; на Claude Haiku 4.5 (1$/млн входных токенов) это выходит примерно в 1,30$ за тысячу картинок, на Claude Opus 5 в high-res режиме — уже 6,48$ за тысячу, а для 4K-изображения счёт доходит до 23,92$ за тысячу (там же). Anthropic сама оговаривает: это иллюстративный расчёт, а не фиксированная цена — реальная сумма зависит от выбранной модели и фактического разрешения файлов.

Есть и содержательные ограничения, которые Anthropic честно перечисляет в документации, а не прячет в мелком шрифте: модель отказывается называть людей на фото, может галлюцинировать на изображениях низкого качества, повернутых или мельче 200 px, считает объекты приблизительно, а не точно, не годится для диагностики по КТ и МРТ — и, что особенно важно для 2026 года, не отличает AI-сгенерированное изображение от настоящего.

Сильный контраргумент: Claude не лидер в OCR

02 evidence

Расхожий тезис «Claude лучший в чтении документов» не выдерживает независимой проверки. Сервис Koncile прогнал Claude, GPT и Gemini через 500 счетов-фактур — 300 текстовых PDF и 200 сканов — и Claude не выиграл ни в одной категории: 97% точности извлечения данных на текстовых документах против 98% у GPT и 96% у Gemini, а на сканах — 90% против 94% у Gemini и 91% у GPT (Koncile, Claude, GPT or Gemini). Koncile — коммерческий сервис извлечения данных, заинтересованный в демонстрации собственной экспертизы, а методология теста не проходила независимого рецензирования, но цифры достаточно конкретны, чтобы им доверять больше, чем маркетинговым слоганам.

Значит ли это, что превосходство Claude — миф? Не совсем. Реальное преимущество Koncile фиксирует не в точности распознавания, а в стабильности формата вывода — 100% валидный JSON, — и в наличии кодовых инструментов для оформления результата после распознавания. Иными словами: Claude не обязательно точнее прочитает скан счёта, но надёжнее превратит прочитанное в структуру, с которой можно работать дальше без ручной правки.

Artifacts, Claude Design и споры о том, что это вообще такое

Здесь начинается путаница, которая и приводит людей к поиску «claude фото». В апреле 2026 Anthropic выпустила Claude Design на модели Claude Opus 4.7 — инструмент для прототипов, макетов, слайдов и одностраничников (анонс Anthropic). TechCrunch описал продукт как конкурента Canva и Figma, а не генераторов изображений: результат экспортируется как PDF, ссылка или PPTX, но не как готовая картинка (TechCrunch). Чуть раньше, в марте, появилась ещё одна функция — inline-визуалы, которые строят диаграммы и графики прямо в переписке, включена по умолчанию на всех платных и бесплатном плане (анонс Claude builds interactive visuals).

Независимые издания разошлись в оценке того, что это вообще такое. AlternativeTo назвало inline-визуалы шагом «на пути к генерации изображений» (AlternativeTo) — заголовок создаёт ложное ожидание, потому что технически речь о кодовом рендеринге, а не о растровой картинке. На Hacker News пользователь furyofantares сформулировал это точнее: «Anthropic has no image generation models» — вместо диффузионной модели Claude Design опирается на CSS, эмодзи и SVG. Другой участник треда, svelle, считает такой узкий фокус честным продуктовым решением — модель не пытается конкурировать в опасной зоне произвольной генерации, а делает то, что умеет надёжно. Третий, mickdarling, настроен резче: одна попытка построить дизайн-систему в Claude Design израсходовала у него 95% недельной квоты Pro-плана, и он назвал продукт «игрушкой» (обсуждение на Hacker News). Это анекдотический случай одного пользователя, а не статистика по всем аккаунтам, но он полезен как предупреждение: лимиты на такие функции расходуются быстро.

Чек-лист: что реально закрывает Claude, а что — нет

03 decision
ЗадачаЗакрывает ClaudeЧем закрыть, если нет
Прочитать скриншот, скан, таблицу, схемуДа, через vision-анализ
Прочитать PDF или презентациюДа
Построить диаграмму, график, интерактивный визуалДа, кодом — Artifacts, inline-визуалы
Собрать прототип, слайд, макетДа — Claude Design
Нарисовать картинку с нуляНетОтдельный генератор (GPT Image, Midjourney и т. п.)
Отредактировать существующее фотоНетОтдельный редактор/генератор
Отличить AI-фото от настоящегоНет, модель прямо об этом предупреждаетСпециализированные детекторы
Точный подсчёт объектов на фотоНет, только приблизительноРучная проверка

Что делать сегодня

Если задача — прочитать документы, а не нарисовать картинку, Claude решает её без стороннего инструмента, но экономически и по точности имеет смысл сравнивать модели, а не верить репутации бренда: разница между 90% и 94% на сканах — это не абстракция, а количество счетов, которые придётся перепроверять руками. Здесь удобно тестировать Claude рядом с GPT и Gemini на одних и тех же документах через общий API — provod.ai даёт такой доступ к каталогу моделей одним OpenAI-совместимым клиентом, без переписывания интеграции под каждого вендора: меняется только base URL.

Если задача — получить именно картинку, единственный рабочий путь — отдельный генератор изображений. Ориентир по цене: GPT Image 1 стоит от 0,011$ за изображение в низком качестве до 0,25$ в высоком (1536px), Mini-версия — от 0,005$ (LangCopilot, GPT Image 1 Pricing). Сам Claude в связке с Claude Design и Claude Cowork доступен в подписке Pro за 17–20$/мес, расширенные лимиты — в Max от 100$ до 200$/мес (Claude Pricing) — но эта подписка не включает генерацию фото ни в каком виде.

Для команды, которая держит и анализ документов, и генерацию картинок в одном рабочем контуре, важнее не конкретный вендор, а контроль расходов на оба процесса: рублёвая оплата и единый баланс организации снимают часть трения, когда счета за визуальные модели растут быстрее, чем ожидалось после истории mickdarling с 95% квоты за один запрос.

Прежде чем принимать решение на основе цифр из этой статьи, стоит помнить: Claude Design и inline-визуалы находятся в статусе research preview с апреля 2026 года, и их лимиты и доступность по тарифам могут измениться за квартал-два.

provod.ai — маршрутизация моделей внутри агентного сценария

Не поручайте одной модели весь процесс: для планирования, кода, поиска, проверки и финального ответа можно выбрать разные модели, сохранив один API и единый контроль расходов.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Экономика каждого шага остаётся видимой: все модели тарифицируются 1:1 по официальным ценам, без дополнительной комиссии provod.ai за маршрутизацию.

Соберите эффективного AI-агента: форма регистрации · цены на модели · защита данных по 152-ФЗ · API и интеграции

Источники