Алексей Маркин рабочий журнал

ищет по заголовкам и тексту записей и заметок

заметка 15 сентября 2026 г. · 2 мин
Все заметки

Можно ли проверить текст на ИИ

Детектор нейросети выдаёт вероятность, а не доказательство, и ошибается на простых текстах людей. Надёжнее оценивать не происхождение текста, а то, проверяются ли его факты.

Короткий ответ: надёжно — нет. Детектор нейросети выдаёт оценку вероятности, а не доказательство, и ошибается в обе стороны: пропускает отредактированный машинный текст и помечает машинным текст человека. Его вывод годится как повод присмотреться, но не как основание для обвинения.

Показательнее всего история самой OpenAI. В январе 2023 года компания выпустила собственный классификатор и сразу написала, что в её проверке он узнаёт лишь 26% машинных текстов, а человеческий текст принимает за машинный в 9% случаев. Там же предупредили, что на текстах короче тысячи знаков он очень ненадёжен, а применять его стоит только к английскому. Уже 20 июля того же года его отключили из-за низкой точности.

Кого детекторы подводят. Многие из них смотрят, насколько предсказуем выбор слов. Простой текст предсказуем, кто бы его ни писал. В исследовании 2023 года через семь популярных детекторов прогнали экзаменационные сочинения людей, для которых английский не родной, и больше половины из них детекторы признали машинными. Та же работа показала и обратное: простая просьба к модели писать богаче обходит проверку.

Рабочее правило. Я не спрашиваю, кто написал текст. Я спрашиваю, что в нём можно проверить: есть ли у цифры источник, существует ли упомянутый пункт документа, сходится ли пример с реальностью. Выдуманная ссылка одинаково плоха у человека и у модели, а уверенный тон ничего не доказывает. Текст, в котором проверять нечего, — тоже сигнал, но не о происхождении: машинный текст не рискует, а пустая человеческая отписка не рискует точно так же.

Где правило не работает. Там, где происхождение и есть предмет вопроса: учебная работа, конкурс с запретом генерации, спор об авторстве. Отчёт детектора и там остаётся вероятностью. Опора — черновики, история правок и записанный замысел, то есть то, что стоит фиксировать ради авторских прав. Это не юридическая консультация: оценку под конкретный спор даёт юрист.

С русским текстом я осторожен вдвойне. Если детектор предъявляют как улику, первый вопрос к нему — мерил ли кто-нибудь его ошибки на русском и на текстах такой длины.