Сегодня сочинение, реферат или эссе могут проверять не только на заимствования, но и на признаки работы нейросети. Для этого используют ИИ-детекторы — например, Turnitin и GPTZero. Но такие системы не знают наверняка, кто написал текст. Они анализируют его особенности и могут ошибаться. Разберёмся, как работает ИИ-детектор текста, насколько ему можно доверять и чем проверка текста на ИИ отличается от антиплагиата.
Как работает ИИ-детектор
ИИ-детектор анализирует текст и ищет в нём признаки работы нейросети. Например, проверяет, насколько он предсказуем, как построены предложения и часто ли повторяются похожие конструкции.
Один из параметров — перплексия. Она показывает, насколько легко языковой модели предугадать следующие слова. Чем ниже перплексия, тем более предсказуем текст для выбранной модели. Некоторые детекторы считают низкую перплексию одним из признаков машинной генерации. Но это не доказательство: человек тоже может писать предсказуемо.
Детектор может учитывать и структуру текста: например, насколько похожи предложения по длине и построению, часто ли повторяются одинаковые конструкции. Некоторые ИИ-тексты действительно отличаются такой «ровностью». Но человек тоже может писать очень структурированно, а нейросеть — использовать разнообразные конструкции.
Детекторы оценивают сразу несколько особенностей, причём каждый делает это по-своему. Поэтому одну и ту же работу разные системы могут оценить по-разному.
Насколько точны ИИ-детекторы
Результат проверки зависит от сервиса, языка и жанра текста, его длины, используемой нейросети и последующего редактирования. Поэтому два детектора могут по-разному оценить одну и ту же работу. Результат такой проверки часто выражают через AI-score — оценку, которую ИИ-детектор присваивает тексту. Но разные сервисы рассчитывают этот показатель по-разному, поэтому их проценты нельзя сравнивать напрямую. Например, в Turnitin процент означает долю текста, которую сервис смог проанализировать и счёл вероятно созданной ИИ.
В исследовании 2025 года детектор Corrector присвоил академическим текстам, написанным людьми, средний AI-score 36,90%, а версиям GPT-3.5 — 94,19%. В другом исследовании того же года GPTZero присвоил большинству работ, полностью созданных нейросетью, AI-score от 91 до 100%. При этом иногда детектор ошибочно относил к машинным и работы людей.
На результат влияет и объём текста. Поэтому некоторые сервисы устанавливают минимальный объём для проверки. Чем короче фрагмент, тем осторожнее стоит относиться к результату такого анализа.
Может ли ИИ-детектор ошибиться
ИИ-детектор может решить, что текст создан нейросетью, хотя на самом деле его полностью написал человек. Это называется ложным срабатыванием. Такое возможно, потому что детектор не устанавливает авторство, а анализирует особенности текста, которые считает характерными для работы нейросети.
Например, ученик самостоятельно написал сочинение простым и ровным языком: предложения похожи по длине, мысли изложены последовательно, некоторые конструкции повторяются. Детектор может обнаружить эти признаки и присвоить работе высокий AI-score. При этом никакой нейросетью ученик не пользовался — программа просто неверно оценила текст.
Например, разработчики Turnitin рекомендуют не принимать решения только на основании такой проверки, а использовать её результат как повод внимательнее изучить работу.
Антиплагиат и ИИ-детектор: в чём разница
Антиплагиат и ИИ-детектор проверяют текст по-разному. Антиплагиат ищет совпадения с другими материалами, а ИИ-детектор — признаки машинной генерации.
- Антиплагиат сравнивает работу с доступными ему источниками: публикациями, сайтами, статьями и другими материалами из базы. Если находит похожий фрагмент, отмечает совпадение и показывает источник.
- ИИ-детектор не ищет источник конкретной фразы. Он анализирует особенности текста — например, его предсказуемость, построение предложений и повторяющиеся конструкции — и оценивает признаки машинной генерации.
Например, в Turnitin для этих проверок существуют два отдельных отчёта: Similarity Report показывает совпадения с источниками, а AI Writing Report — признаки машинной генерации.
Перефразирование и ИИ-детектор
Перефразирование может изменить результат проверки текста на ИИ, потому что вместе с формулировками меняются и признаки, которые анализирует детектор. Это видно на исследовании 2024 года, проведённом на медицинских материалах:
- Turnitin правильно распознал 94% исходных текстов ChatGPT, но после ИИ-перефразирования — только 30%.
- Originality.ai на той же выборке правильно классифицировал 100% работ обеих групп.
Получается, перефразирование способно затруднить работу некоторых детекторов, но не обязательно повлияет на другие.
Отдельная сложность — смешанные работы, в которых часть написал человек, а часть создала нейросеть. Здесь качество распознавания зависит от доли и характера машинных фрагментов, а также от используемого детектора.
Проверка сочинения на ИИ в школе, на ЕГЭ и ОГЭ
В школе правила использования нейросетей могут отличаться. Поэтому перед выполнением задания лучше уточнить требования учителя или школы.
На ЕГЭ и ОГЭ правила строже. Во время экзамена можно использовать только то, что разрешено для конкретного предмета. Пользоваться телефоном и другими запрещёнными устройствами нельзя. Значит, зайти с них в ChatGPT или другой онлайн-сервис с ИИ во время экзамена тоже нельзя.
На итоговом сочинении также нельзя пользоваться телефоном, своими справочными материалами и заметками. Орфографический словарь при необходимости выдаёт организатор. Поэтому обратиться к нейросети во время написания сочинения не получится.
Главное
ИИ-детектор может заметить в тексте признаки, характерные для работы нейросети, но не может точно установить, кто его написал. Он способен ошибиться и присвоить высокий AI-score даже работе, которую человек выполнил самостоятельно. Поэтому результат проверки на ИИ нужно оценивать вместе с самой работой и учитывать правила школы или другого учебного заведения.