20 июля автор сервиса unslop сообщил: в последнем полном квартале его ии детектор пометил примерно 32% текстов в выборке arXiv как похожие на машинное письмо. Число звучит так, будто треть работ можно немедленно записать в «написанные ИИ». Но методика самого анализа запрещает этот вывод.
Перед редактором, преподавателем или руководителем стоит не абстрактный вопрос о нейросетях. Решение вполне конкретно: считать ли высокий score основанием для санкции против автора или использовать его как сигнал, что в массиве текстов меняется стиль письма. Во втором случае у измерения есть смысл. В первом оно быстро становится неверным.
Платите в рублях за AI-модели без наценки на токены через provod.ai
Что именно измеряли
Анализ охватил 12 750 полнотекстовых PDF первой версии на arXiv. В выборку вошли десять научных направлений: примерно по 25 работ на направление в месяц с января 2023 года по июль 2026 года. Для сравнения добавили восемь контрольных месяцев 2021–2022 годов, то есть тексты до широкого распространения LLM.
Выбор первой версии важна: поздние правки меньше рискуют попасть в документ, датированный ранним периодом. Но даже такая аккуратность не превращает результат в перепись использования ИИ. Детектор фиксирует текстовое сходство с тем, что его модель считает машинным стилем, выше заданного порога.
На историческом контроле система пропустила 99,6% человеческих научных текстов. Это даёт заявленный автором уровень ложных срабатываний 0,4%. Также автор оценил восстановление ИИ-академического текста в 85%; вокруг показателей приведены bootstrap 95% доверительные интервалы.
Это похоже на хороший термометр для изменения температуры в городе. Он может показать, что средняя температура растёт. Но он не скажет, кто именно в конкретном доме включил отопление и почему.
Откуда берутся 32%
В этой конфигурации доля помеченных работ достигла примерно 32% в последнем полном квартале, а в начале 2026 года доходила примерно до 39%. Между направлениями разрыв огромен: для computer science показатель около 65%, для mathematics около 0,7%.
Именно здесь самый соблазнительный вывод оказывается самым слабым. Нельзя читать 65% как «65% работ полностью сгенерированы», а 0,7% как доказательство почти полного отсутствия ИИ у математиков. Математическая проза часто разрежена, насыщена формулами и может лежать вне обучающего распределения детектора. Низкий score способен означать как меньшую распространённость таких практик, так и слепую зону измерителя.
Детектор не знает и реальную смесь закрытых моделей, промптов и способов работы с текстом. Он не отличает лёгкую редактуру от полной генерации. Поэтому ответ на популярный вопрос «как антиплагиат определяет ии» здесь должен быть скромнее ожиданий: он не устанавливает историю создания текста, а сопоставляет его стиль с выученным паттерном.

Поворот: сильный результат становится слабым обвинением
Исторический контроль и явный порог делают работу полезнее многих разговоров об «ИИ-контенте в антиплагиате». Но та же самая калибровка не переносится автоматически на единичный текст.
Даже низкая доля ложных срабатываний в контрольной популяции не отвечает на вопрос об одном авторе, одном жанре и одном документе. У конкретной работы меняются объём прозы, дисциплина, стиль формулировок, доля формул и редакторская история. А в пограничных случаях именно эти различия важнее красивого процента на экране.
Автор анализа формулирует ограничение прямо: flag показывает сходство текста с машинным стилем, а не авторство конкретного человека. Это не юридическая оговорка внизу страницы, а главное правило применения результата.
Самое сильное возражение
К анализу стоит относиться критически ещё и потому, что его опубликовал создатель собственного detector-продукта. Это методический пост, а не независимое peer-reviewed исследование. Прозрачность описания выборки и контролей полезна, но не отменяет конфликта интересов и не делает цифры академическим консенсусом.
Техническое обсуждение вокруг публикации было заметным: на Hacker News тема получила 235 points и 161 комментарий. Участники проверяли старые тексты, гибридное письмо и ложные срабатывания. Такие проверки хорошо показывают, где искать проблемы, но остаются отдельными примерами, а не новой репрезентативной валидацией.
Из этого не следует, что измерение бесполезно. Следует другое: его сила ровно там, где исследователь не обещает больше, чем измерил.
Практическое правило для проверки
Если вам нужна проверка на ии детектор, разделите решения на два уровня.
- Для массива текстов используйте score как индикатор тренда. Проверьте, есть ли исторический control, как задан порог, какие жанры и поля покрыты, а также опубликованы ли интервалы неопределённости.
- Для отдельной работы не делайте score доказательством. Высокий флаг должен открыть проверку контекста, а не завершить её.
- Для решения с последствиями ищите следы процесса: черновики, историю редактур, комментарии, согласованные правила использования инструментов и разговор с автором. Это доказательства происхождения, а не догадка по стилю.
- Не сравнивайте дисциплины буквально, пока не показана валидность детектора именно на их текстах. Особенно осторожно интерпретируйте короткую, формульную или жанрово нетипичную прозу.
Такой протокол не отвечает на запрос «как пройти антиплагиат на ии» и не должен отвечать: он меняет цель с обхода проверки на честную процедуру, в которой случайный стиль не становится поводом для ошибочного наказания.
Там, где detector лишь предполагает историю текста по его поверхности, provod.ai может показывать provenance создания и историю редактур для последующей человеческой проверки. Это не заменяет правила и экспертизу, но переносит разговор от вероятностного ярлыка к наблюдаемому процессу.

Если на кону допуск к публикации, оценка или репутация автора, что разумнее: принять быстрый вероятностный score или потратить время на проверку истории создания и человеческий разбор?
provod.ai — российский AI API-роутер для личных и корпоративных сценариев
Один API и веб-интерфейс объединяют привычную AI-экосистему: от первого запроса в чате до агентных систем, мультимедиа и production-интеграций для бизнеса.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Ценовая основа платформы — официальный тариф без собственной маржи: 1:1 с провайдером, оплата в рублях, единый баланс и документы для бизнеса. Это один из самых прямых и доступных способов оплачивать мировой AI-каталог из России.
Подключитесь к provod.ai: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai
