Главная / Статьи

Turnitin, Антиплагиат.ВУЗ и GigaCheck: чем отличаются и кто строже

РазборКоманда КотПишетСам·8 мин чтения·сентябрь 2026

Если мерить строгость последствиями, впереди Антиплагиат.ВУЗ: по данным «Коммерсанта» от 28 апреля 2026 года, в ряде российских вузов даже 1% обнаруженной генерации ведёт к отказу в допуске к защите. Turnitin в отчётах осторожнее — при доле ИИ от 1 до 19% он вообще не показывает число, только звёздочку. Лоб в лоб эти системы, впрочем, не сравнить: по языкам они почти не пересекаются, и русский текст Turnitin не оценивает в принципе.

Языки: почему это не одна гонка

Turnitin официально поддерживает английский, испанский и японский, причём детекцию ИИ-парафраза — только для английского. Ограничения по объёму жёсткие: минимум 300 слов связной прозы, максимум 30 000 слов. Антиплагиат.ВУЗ, по памятке сентября 2025 года, работает с русским, английским, испанским и казахским; документ принимается только в PDF или DOCX без OCR и объёмом от двух листов. GigaCheck Сбера заявлен как русскоязычный детектор.

Для студента, который сдаёт и в РФ, и за рубежом, вывод простой. Русская версия ВКР встретится с Антиплагиат.ВУЗ, английская статья — с Turnitin, и это два независимых испытания с разными правилами. Перевод работы на другой язык означает смену детектора со всеми его порогами и слепыми зонами.

Три архитектуры, три философии отчёта

Продакшен-архитектуру не раскрывает ни одна из трёх компаний, но по публикациям кое-что восстановимо. R&D-команда «Антиплагиата» (бренд Advacheck, статьи Грицая, Грабового, Чеховича) описала в «Докладах РАН» за 2023 год классификатор на XLM-RoBERTa и T5 с добавкой 26 ручных признаков — публично подтверждены пять: части речи, пунктуация, индекс Флеша, средняя длина предложения, количество стоп-слов. Заявленный F1 — 0,968 для русского. Отдельная модель (arXiv:2411.07343) классифицирует каждый токен в окне 350 токенов-слов — поэтому отчёт указывает конкретные страницы с подозрительными фрагментами. А работа той же команды на COLING 2025 (arXiv:2411.11736, первое место, macro-F1 83,07%) добавила доменную калибровку: научный текст судят по своей, более строгой шкале, чем блог или эссе.

Turnitin архитектуру модели не публикует вовсе — известна только процедура агрегации: документ режется на перекрывающиеся сегменты по 5–10 предложений, каждое предложение получает балл 0 или 1, документный процент считается как среднее по сегментам.

GigaCheck (Sber/SberDevices, Findings of ACL 2026) устроен третьим способом: fine-tuned LLM оценивает документ целиком, а DETR-подобная модель локализует «ИИ-интервалы» как объекты — приём из компьютерного зрения, перенесённый на текст. Заявленная точность — 94,7% при FPR не выше 1%. Здесь данные слабые, и это надо сказать прямо: независимых рецензируемых проверок GigaCheck не существует, как и проверок детектора «Антиплагиата» — все цифры по русскоязычным системам исходят от самих вендоров.

Кто честнее про свои ошибки

Ключевая асимметрия Turnitin спрятана в мелком шрифте: заявленный FPR ниже 1% относится только к документам с долей ИИ от 20%, а на уровне отдельного предложения FPR около 4%. Отсюда и звёздочка в диапазоне 1–19% — малым процентам компания сама не доверяет. При 4% на предложение эссе в 500 слов почти гарантированно получит хотя бы одну ложную подсветку. И ошибки эти не случайны: 54% ложных срабатываний стоят вплотную к настоящему ИИ-тексту, ещё 26% — через одно предложение. Смешанный человеко-ИИ текст — худший режим для детектора.

«Антиплагиат» 9 июля 2026 года отчитался о снижении ложных срабатываний с 1,55% до 0,15% по документам — тест на 1500 документах с примерно десятью моделями. Параллельно РИА сообщило: за второй квартал 2026-го проверено 2,73 млн работ, признаки ИИ найдены в 983,7 тыс. — в каждой третьей. Сама компания при этом называет детектор в памятке «маркером, а не доказательством», отметку о подозрительности эксперт может снять с комментарием, а порог допуска устанавливает вуз локальным актом, не система. Независимого измерения ложных срабатываний на верифицированном корпусе русских ВКР публично не существует — держите это в голове при любом споре. Механику пометок на честных работах мы подробно разбирали в разборе ИИ-детекции.

Pangram: единственное подтверждённое исключение

Общий фон такой: вендоры заявляют точность 99% и выше, независимые обзоры дают 70–87% при FPR 4–15%. На этом фоне выделяется один продукт. Джабарян и Аймас из Chicago Booth в сентябре 2025 года прогнали около 2000 человеческих текстов в шести жанрах: у Pangram FPR оказался около нуля при пропусках 0–2%. Pangram 4 (arXiv:2607.27183, июль 2026) заявляет FPR 0,0041% — одно ложное срабатывание примерно на 24 300 текстов — и поддержку 104 языков.

Но и тут нашлась трещина. Карр с соавторами из Notre Dame (arXiv:2608.11256) проверили 642 научных абстракта: Pangram 3.2 помечает 26,6% теологических против 2,1% химических, причём срабатывает и на текстах 2013–2015 годов — написанных до появления LLM. Детекторы измеряют стиль, а не факт генерации, и тексты, которые физически не могли быть сгенерированы, — прямое тому доказательство.

Практический вывод отсюда один. Попытки «обмануть антиплагиат» машинным перефразированием не работают: наивный парафраз иногда повышает детектируемость (у Fast-DetectGPT — на 15,03%), а гомоглифы и невидимые символы ловятся отдельными проверками и выглядят как умысел. Бенчмарк ARB (июль 2026) показал, что решает происхождение содержания, а не поверхностная правка — почему так и что в этой логике делает хьюманайзер, мы разбирали отдельно.

Вопрос — ответ

Проверит ли Turnitin работу на русском языке?

Нет. Официально поддерживаемые языки Turnitin — английский, испанский и японский, а детекция ИИ-парафраза работает только для английского. Русскоязычный текст система корректно не оценивает. Для русского языка на практике действуют Антиплагиат.ВУЗ (русский, английский, испанский, казахский) и GigaCheck Сбера — но независимых рецензируемых проверок обоих не существует, все цифры точности заявлены самими вендорами.

Что означает звёздочка вместо процента в отчёте Turnitin?

Это диапазон от 1 до 19% ИИ-контента, в котором Turnitin сознательно не показывает число. Причина — асимметрия ошибок: заявленный FPR ниже 1% справедлив только для документов с долей ИИ от 20%, а на уровне предложения ошибка около 4%. Малые проценты статистически ненадёжны, и компания прячет их, чтобы не провоцировать обвинения на шатких данных.

Какой детектор ошибается реже всех?

По независимым данным — Pangram: Джабарян и Аймас из Chicago Booth намерили в 2025 году FPR около нуля на 2000 человеческих текстов, а Pangram 4 заявляет 0,0041%. Но и он помечает 26,6% теологических абстрактов против 2,1% химических (Notre Dame, 2026) — доменное смещение никуда не делось. Полностью надёжного детектора на сегодня нет.

Как это решает кот

У кота это устроено как программный комплекс полного цикла: генерация текста — малая часть, вокруг неё тысячи операций — источники с проверкой, структура, расчёты, термины, ГОСТ. Хьюманайзер включён в каждый продукт по умолчанию и доступен отдельно, если текст у вас уже есть. В наших замерах комплекс стабильно показывает 0% ИИ-контента в Антиплагиат.ВУЗ — свежая курсовая с 0% ИИ и 87% оригинальности открыта в примерах готовых работ. Проверить на своей теме: бесплатный план за минуту.

Источники — 12
  1. РИА Новости, 16.07.2026 — «Антиплагиат» обнаружил признаки ИИ в каждой третьей студенческой работе открыть
  2. «Коммерсантъ», апрель 2026 — Студентов не допускают до защиты дипломов из-за ложных срабатываний детектора ИИ открыть
  3. CNews, 09.07.2026 — «Антиплагиат» стал умнее: детектор чувствительнее к ИИ-фрагментам, ложные срабатывания снижены открыть
  4. Официальные разъяснения компании «Антиплагиат» о подозрительных документах и признаках ИИ-текста открыть
  5. Сообщение компании «Антиплагиат» об обновлении алгоритмов детектора, 08.04.2026.
  6. Jabarian B., Imas A. (Chicago Booth), 2025 — независимая оценка точности коммерческих ИИ-детекторов.
  7. Turnitin Guides — AI writing detection model (официальная документация детектора) открыть
  8. GigaCheck (SberDevices) — детектор ИИ-текста, Findings of ACL 2026.
  9. arXiv:2411.07343 открыть
  10. arXiv:2411.11736 открыть
  11. arXiv:2607.27183 открыть
  12. arXiv:2608.11256 открыть
Нужен план по своей теме? Кот соберёт цель, задачи и оглавление за минуту — бесплатно и без регистрации. Готовые работы с проверками — в примерах.

Читать дальше