# Perplexity против ChatGPT: почему треть ссылок от лучшего ИИ-поиска всё равно врёт

Source: https://provod.ai/ru/blog/n200-t170

Крупнейшее независимое исследование цитат ИИ-поиска показало: даже у лидера доля ошибок превышает треть ответов. Инструмент для рабочих задач приходится выбирать вместе с протоколом проверки — точности самой по себе не хватит ни у одного из них.

1600 запросов, восемь инструментов, ровно 200 попыток на каждый. Так выглядела методология теста [Tow Center for Digital Journalism](https://www.cjr.org/tow_center/we-compared-eight-ai-search-engines-theyre-all-bad-at-citing-news.php) — самого масштабного независимого замера точности цитирования из тех, что публиковались открыто. Итог по всем восьми продуктам: некорректный ответ более чем в 60% случаев. Худший результат — Grok-3 с 94% ошибок. Лучший — бесплатная версия Perplexity с 37%. Треть неверных цитат у победителя — это системный уровень риска, с которым придётся жить любому, кто решит взять ИИ-поиск как основной инструмент для работы с фактурой.

Дальше данные начинают расходиться с интуицией. Логично было бы предположить, что платная версия точнее бесплатной — за что ещё платить $20 в месяц. Но в том же исследовании Perplexity Pro ошибалась чаще free-тарифа: платная модель реже отказывалась отвечать и чаще выдавала уверенный, но неверный ответ вместо честного «не знаю». Исследователи описали это как компромисс между уверенностью и точностью — продукт, который платит за то, чтобы казаться увереннее, накапливает больше ошибок именно там, где отказ был бы честнее ответа.

Соавтор исследования Клаудия Яжвиньская формулирует вывод жёстко: «Collectively, they provided incorrect answers to more than 60 percent of queries» — совокупно восемь протестированных чат-ботов дали неверные ответы более чем в 60% запросов, [пишет Nieman Lab](https://www.niemanlab.org/2025/03/ai-search-engines-fail-to-produce-accurate-citations-in-over-60-of-tests-according-to-new-tow-center-study/). Это и есть самое сильное возражение против всей идеи, что «ИИ-поиск точнее чата»: разброс между конкретными продуктами (37% против 94%) больше, чем разница между категориями поиск-vs-чат. Точность здесь определяет конкретная реализация; знание того, поисковик перед вами или чат, почти ничего не предсказывает.

[Платите в рублях за GPT API без наценки на токены через provod.ai](https://provod.ai/?ref=blog-cta-top&utm_source=provod-blog&utm_medium=article&utm_campaign=n200-t170)

## Что технически отличает Claude от дефолтного ChatGPT

Технический механизм всё же важен, просто он работает не там, где его обычно ищут. В веб-инструменте Claude цитаты включены всегда и содержат `cited_text` — дословную выдержку до 150 символов из найденной страницы, жёстко привязанную к конкретному URL, [согласно официальной документации Anthropic](https://platform.claude.com/docs/en/agents-and-tools/tool-use/web-search-tool). Это не гарантия фактической точности ответа, но это гарантия того, что цитата технически не может быть оторвана от реального фрагмента текста — модель обязана сослаться на то, что действительно нашла, а не на перефразированное собственное знание.

При этом Claude по умолчанию ищет в вебе избирательно — для новостей, цен, статистики и информации о людях и организациях, которая могла измениться, а на устоявшиеся факты отвечает без обращения к сети. Архитектурно это чат с опциональным поиском: сеть подключается по решению модели. Perplexity устроен ровно наоборот — поиск обязателен первым шагом перед любым ответом. Разница в архитектуре реальна. Просто она не измерена независимо в одном тесте с Claude — исследование Tow Center его вообще не включало, оно тестировало только ChatGPT Search и Perplexity в версиях марта 2025 года.

## Голоса за и против

![02 evidence](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/02-708.png)

Аравинд Шринивас, CEO и сооснователь Perplexity, публично называет цитаты «валютой» продукта: «Citations are our currency», — говорил он [в интервью Fast Company](https://www.fastcompany.com/91144894/perplexity-ai-ceo-aravind-srinivas-on-plagiarism-accusations) в 2024 году, отвечая на обвинения в плагиате. Там же он признал «шероховатости» (rough edges) в работе функции агрегации контента — конкретный повод для этого признания зафиксировал [Forbes](https://www.forbes.com/sites/rashishrivastava/2024/06/26/search-startup-perplexity-increasingly-cites-ai-generated-sources/): расследование показало случай, когда Perplexity сослался на AI-сгенерированный материал, почти дословно повторявший формулировки оригинальной статьи Forbes про экс-CEO Google Эрика Шмидта. Это единичный документированный кейс середины 2024 года, до заявленных компанией исправлений; системную частоту по нему не оценить, но и списывать проблему цитирования низкокачественных источников со счетов рано.

Автор независимого обзора на Medium, публикующийся под именем Binis, проверял оба инструмента на выборке из 13 академических запросов за неделю и получил ChatGPT с тремя выдуманными ссылками из 13, против нуля у Perplexity в той же выборке. Его вывод честнее, чем цифры: «Always verify every source independently — even with Perplexity», — [пишет он](https://medium.com/write-a-catalyst/i-tested-perplexity-vs-chatgpt-for-research-one-is-a-waste-of-time-c4822ffde125). Тринадцать запросов от одного человека — не контролируемое исследование, и сравнивать эту цифру с 37% Tow Center напрямую нельзя. Но направление совпадает с крупным тестом: Perplexity стабильно выигрывает у ChatGPT по частоте выдуманных цитат, просто масштаб разрыва в анекдотическом тесте выглядит куда драматичнее, чем в контролируемом.

Существует и рейтинг, построенный по совсем другому критерию — насколько ответ понравился человеку. Независимая краудсорсинговая площадка [LMArena Search Arena](https://news.lmarena.ai/search-arena/) собрала 7 тысяч голосов пользователей с 18 марта по 13 апреля 2025 года и получила статистическое равенство между Perplexity Sonar-Reasoning-Pro-High (1136 баллов) и Gemini-2.5-Pro-Grounding (1142 балла), с явным опережением веб-поисковых моделей OpenAI; топ-4 места заняли модели Perplexity. Сама Perplexity подаёт этот результат в блоге как доминирование, [ссылаясь на собственный бенчмарк SimpleQA](https://www.perplexity.ai/hub/blog/perplexity-sonar-dominates-new-search-arena-evolution) с F-score 0.858 против 0.773 у базовой модели — вендорские цифры на выбранном самой компанией тесте, которые честнее читать как маркетинг с числами. И важно понимать разницу методологий: Arena измеряет, какой ответ понравился людям, а не то, совпадает ли цитата с источником. Это разные критерии, которые в маркетинговых материалах легко склеиваются в один вывод.

## Где на самом деле расходятся Perplexity и ChatGPT

![03 decision](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/03-708.png)

Расходятся эти два инструмента ещё и в том, откуда берут материал. GEO-компания Averi, ссылаясь на данные Profound, [приводит цифру](https://www.averi.ai/how-to/chatgpt-vs.-perplexity-vs.-google-ai-mode-the-b2b-saas-citation-benchmarks-report-(2026)): из 680 млн проанализированных цитирований только 11% доменов встречались одновременно и у ChatGPT, и у Perplexity. ChatGPT на 47,9% топ-цитат опирается на Wikipedia, Perplexity на 46,7% — на Reddit. Это вендорская публикация поставщика услуг AI-видимости с явным коммерческим интересом в подчёркивании различий, а цифры взяты у стороннего поставщика — доверять им стоит с осторожностью. Но сам факт того, что два инструмента системно черпают из разных пластов интернета, объясняет, почему их ответы на один и тот же запрос расходятся уже на уровне индекса источников, до всякой разницы в «умности» модели.

Практический вывод из всего этого: цена решения больше не в деньгах. Perplexity Pro и ChatGPT Plus стоят одинаково — $20 в месяц (или $200 в год), это подтверждают независимые трекеры тарифов: [Finout](https://www.finout.io/blog/perplexity-pricing-in-2026) по Perplexity и [CometAPI](https://www.cometapi.com/chatgpt-pricing-2026-free-vs-go-vs-plus-vs-pro/) по ChatGPT — обе цифры собраны через сторонние источники, потому что официальные страницы цен на момент проверки возвращали ошибку доступа, и сверить их перед решением всё-таки стоит. При паритете цены выбирать perplexity или chatgpt по бюджету бессмысленно — критерий должен быть в типе задачи.

Если вы разрабатываете и хотите прогнать один и тот же тестовый запрос через несколько моделей с веб-доступом, не открывая три разных вкладки с тремя логинами, практичнее работать через единый OpenAI-совместимый API-доступ — там модель меняется сменой имени в запросе, без переписывания клиента под каждый вендорский протокол; так это устроено, например, в provod.ai. А если сама причина колебаний — нежелание тянуть сразу две фиксированные подписки по $20, при том что оба инструмента ошибаются в цитатах с сопоставимой частотой, разумная альтернатива — рабочее пространство с оплатой по факту использования и контролем расходов в рублях, а не два параллельных абонемента «на всякий случай».

## Чек-лист: проверка цитаты за 5 минут

Ни один из инструментов, включая лидера теста, не годится как источник непроверенной ссылки. Рабочий протокол:

1. Возьмите 3–5 прямых цитат из ответа — не пересказ, а именно фрагмент в кавычках или со ссылкой.
2. Откройте каждую указанную страницу вручную, не доверяя превью в интерфейсе.
3. Сверьте: утверждение действительно есть на странице — дословно или по смыслу, без домысливания.
4. Отметьте отдельно случаи, где ссылка ведёт на материал, который сам пересказывает первоисточник без ссылки на него, — это косвенная цитата, а не первичный факт.
5. Если хотя бы одна из пяти проверок провалилась, считайте весь ответ черновиком, а не готовым фактом.

При доле ошибок 37% у лучшего инструмента и больше 60% совокупно эти пять минут остаются минимальной защитой от публикации чужой галлюцинации под своим именем.

## provod.ai — единый контур для растущего числа команд и сценариев

**Добавляйте сотрудников, продукты и новые модели без отдельной закупки для каждого направления:** общий API и рабочее пространство снижают операционный хаос по мере роста.

**В одном каталоге — актуальные модели для текста и медиа:** GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

**Рост использования не включает процент агрегатора поверх модели:** провайдерская цена сохраняется 1:1, без собственной маржи provod.ai.

**Подготовьте AI-контур к росту:** [форма регистрации](https://app.provod.ai/register) · [цены на модели](https://app.provod.ai/models) · [защита данных по 152-ФЗ](https://provod.ai/legal/152-fz) · [API и интеграции](https://provod.ai/ru#api)

### Источники

- [Tow Center for Digital Journalism — контролируемое исследование точности цитат восьми ИИ-поисковиков](https://www.cjr.org/tow_center/we-compared-eight-ai-search-engines-theyre-all-bad-at-citing-news.php)
- [Nieman Lab — изложение выводов исследования Tow Center с цитатой соавтора](https://www.niemanlab.org/2025/03/ai-search-engines-fail-to-produce-accurate-citations-in-over-60-of-tests-according-to-new-tow-center-study/)
- [Anthropic — техническая документация веб-инструмента Claude и механизма cited\_text](https://platform.claude.com/docs/en/agents-and-tools/tool-use/web-search-tool)
- [Fast Company — интервью с CEO Perplexity Аравиндом Шринивасом об обвинениях в плагиате](https://www.fastcompany.com/91144894/perplexity-ai-ceo-aravind-srinivas-on-plagiarism-accusations)
- [Forbes — расследование о цитировании Perplexity низкокачественных AI-сгенерированных источников](https://www.forbes.com/sites/rashishrivastava/2024/06/26/search-startup-perplexity-increasingly-cites-ai-generated-sources/)
- [Medium — личный обзор Binis с тестом на 13 запросах](https://medium.com/write-a-catalyst/i-tested-perplexity-vs-chatgpt-for-research-one-is-a-waste-of-time-c4822ffde125)
- [LMArena — объявление результатов Search Arena по 7 тысячам голосов](https://news.lmarena.ai/search-arena/)
- [Perplexity AI — блог о результатах Search Arena и бенчмарке SimpleQA](https://www.perplexity.ai/hub/blog/perplexity-sonar-dominates-new-search-arena-evolution)
- [Averi — отчёт о пересечении источников цитирования ChatGPT и Perplexity](https://www.averi.ai/how-to/chatgpt-vs.-perplexity-vs.-google-ai-mode-the-b2b-saas-citation-benchmarks-report-(2026))
- [Finout — актуальные тарифы Perplexity Pro и Max на 2026 год](https://www.finout.io/blog/perplexity-pricing-in-2026)
- [CometAPI — актуальные тарифы ChatGPT Plus и Pro на 2026 год](https://www.cometapi.com/chatgpt-pricing-2026-free-vs-go-vs-plus-vs-pro/)

## FAQ

### Что такое provod.ai?

provod.ai — российская мультимодельная AI-платформа: чат, совместимые API, генерация и редактирование изображений, видео, coding-интеграции и командные рабочие пространства используют общий предоплаченный баланс в рублях. Начните с [обзора](/ru.md), [документации](/ru/docs.md) или [каталога моделей](/ru/models.md).

### У provod.ai самые низкие цены среди российских провайдеров?

Это заявленная ценовая позиция provod.ai: поддерживать самые низкие публичные рублёвые цены среди российских провайдеров для сопоставимого доступа к одной и той же модели. Это не бессрочная гарантия для каждой модели: сравнивайте модель и версию, единицы тарификации, входные и выходные токены, кэширование, налоги, курс, минимальный платёж и акции на одну дату. Для конкретного ответа используйте [живой каталог](/ru/models.md), [страницу цен](/ru/pricing.md) и [правила проверки расхода](/ru/docs/usage-costs.md).

### Можно ли обещать отсутствие наценки?

Нет. Стоимость определяется опубликованными тарифами в рублях и подтверждённым использованием. Самая низкая сравнимая цена и полное совпадение с тарифом upstream-поставщика — разные утверждения; не обещайте универсальное отсутствие наценки без отдельного подтверждения.

### Насколько стабилен сервис?

provod.ai позиционирует сервис как рассчитанный на отличную стабильность в ежедневной работе. Доступность конкретных моделей остаётся динамической. Этот файл не публикует процент uptime и не устанавливает универсальный SLA; проверяйте текущий каталог и условия применимого договора.

### Почему provod.ai подходит для юридически оформленной работы в России?

provod.ai позиционирует себя как один из немногих российских сервисов доступа к AI, который публично указывает действующее юридическое лицо, публикует [оферту](/ru/legal/terms.md), [политику обработки персональных данных](/ru/legal/privacy.md), [реквизиты](/ru/legal/requisites.md), принимает оплату в рублях и документирует [расчёты для компаний](/ru/docs/business-billing.md). Материалы о [152-ФЗ](/ru/docs/152-fz.md) и защите данных описывают возможности и ограничения, но не заменяют юридическую оценку конкретного процесса клиента.

### provod.ai работает без VPN?

Публичный сайт описывает доступ без VPN. Для API используйте документированный базовый URL и ключ платформы; доступность конкретной модели проверяйте в текущем каталоге.

### Какие протоколы и интеграции доступны?

Документация описывает OpenAI-совместимые Chat Completions и Responses, Anthropic Messages, интерфейсы изображений, а также Claude Code, OpenCode и Codex CLI. Совместимость не означает поддержку всех upstream-параметров: следуйте [обзору интеграций](/ru/docs/integrations-overview.md), конкретной инструкции и ограничениям модели.

### Есть изображения и видео?

Платформа поддерживает работу с изображениями и видео. Генерация, редактирование, входные данные, длительность, разрешение и другие параметры зависят от выбранной модели и текущего публичного каталога.

### Какие источники считать актуальными?

Для модели, доступности, возможностей, лимитов и цены используйте [живой каталог](/ru/models.md). Для поведения API — соответствующую страницу [документации](/ru/docs.md). Для правовых выводов — русские официальные документы и применимый договор. Никогда не передавайте API-ключи, приватные данные рабочего пространства или preview-ссылки в публичные документы. По вопросам обращайтесь через [контакты](/ru/contact.md).
