Главная / Статьи

Антиплагиат дипломной работы: что проверяет система и что не видит

РазборКоманда КотПишетСам·11 мин чтения·сентябрь 2026

Коротко: антиплагиат дипломной работы ищет совпадения вашего текста с базами документов — чужими ВКР, статьями, сайтами, — и выдаёт процент оригинальности. Отдельно от этого работает детектор ИИ: он не сравнивает текст ни с чем, а оценивает, насколько формулировки похожи на машинную генерацию. Это две разные проверки с разной логикой, и путать их — самая частая ошибка выпускника.

Две проверки в одном отчёте: заимствования и ИИ

Когда научный руководитель говорит «прогони через антиплагиат», он обычно имеет в виду одну кнопку. Но внутри отчёта живут два независимых механизма, которые отвечают на разные вопросы: антиплагиат ищет заимствования, а детектор ИИ — языковые признаки генерации. Первый показывает процент совпадений и ссылки на найденные источники. Второй — вероятностную оценку и подсвеченные фрагменты, которые модель сочла подозрительными.

Отсюда следует неприятное: высокий процент оригинальности больше не означает «работа принята». Можно получить 92% уникальности и одновременно красный флаг по ИИ — потому что сгенерированный текст по определению ни с чем не совпадает. И наоборот: текст, написанный руками, но собранный из стандартных формулировок по ГОСТу и терминов из законов, спокойно даёт заимствования, которые к плагиату отношения не имеют.

Модуль ИИ появился в системе «Антиплагиат» в начале мая 2023 года. С тех пор он стал обязательной частью пейзажа: в первом квартале 2026 года признаки ИИ нашли в 27% студенческих работ, тогда как годом раньше было 17%.

Как именно считается процент оригинальности

Технически всё довольно приземлённо. Текст нормализуют — убирают знаки препинания, предлоги, союзы и прочий служебный мусор. Дальше идёт шинглование: система нарезает текст на пересекающиеся цепочки слов, обычно по 5–7 слов, каждая цепочка превращается в короткий хеш, и уже хеши сравниваются с базой. Совпал набор хешей — получили процент заимствований.

В другом разборе шингл описывают как цепочку из 3–5 слов, где последнее слово одной последовательности становится первым словом следующей. Длина окна отличается от системы к системе, но принцип один: одно случайное совпадение никого не волнует, а вот цепочка за цепочкой — уже сигнал о заимствовании.

Сравнение идёт не с одной библиотекой, а с большим набором коллекций: открытые источники, научные публикации, архивы вузов. Именно поэтому диплом, переписанный из работы выпускника вашей же кафедры пятилетней давности, находится мгновенно — он лежит в вузовской коллекции.

Поверх шинглов работает модуль перефразирований, и он самый неприятный для тех, кто надеется «переписать своими словами». Тут текст уже не нарезают на цепочки, а переводят в смысловые векторы и считают косинусное расстояние между ними: чем меньше угол между векторами предложений, тем ближе смысл. Синонимайзер и перестановка слов от такой проверки не спасают — утверждение осталось тем же.

Что система не считает плагиатом

Не всё в дипломе обязано быть авторским, и разработчики это понимают. По правилам проверки не снижают уникальность:

  • цитаты, оформленные кавычками и ссылкой;
  • сноски по ГОСТу;
  • библиография и списки источников;
  • термины, общеизвестные определения, устойчивые конструкции.

Ключевое слово — «оформленные правильно». Если вы закавычили цитату, но не поставили ссылку, или оформили сноску по своему разумению, фрагмент уедет в заимствования. Половина паники перед защитой лечится не переписыванием текста, а аккуратной вычиткой ссылочного аппарата.

И даже найденные совпадения — это не приговор. Доцент НИУ ВШЭ Александр Лифшиц объясняет, что определяемые машиной 15% заимствований могут оказаться вовсе не плагиатом, а признаком стандартных конструкций и устойчивых выражений. Программа не указывает степень правонарушения — она расставляет красные флажки, а решает человек. Профессор Ирина Абанкина добавляет, что система нередко принимает за плагиат названия вузов и термины из законов, и при превышении цитирования в пределах допустимых 10–15% научный руководитель может подать справку с разбором спорных фрагментов.

Почему детектор ИИ — это про стиль, а не про источник

ИИ-детектор ничего не ищет в интернете. Он оценивает особенности самого текста: предсказуемость формулировок, повторяемость синтаксических конструкций, статистические закономерности. То есть отвечает не на вопрос «откуда это взято», а на вопрос «насколько это похоже на то, как пишут языковые модели».

В инструкции «Антиплагиата» перечислены признаки, на которые срабатывает система: много повторов, фактические ошибки, поверхностность, обилие общих фраз и банальностей; отсутствие конкретики — имён, дат, событий; скудная лексика или, наоборот, преувеличения; бедность и формальность стилистики; большие буквы после двоеточия; отсутствие технических совпадений с другими работами; ссылки на несуществующие источники; излишняя структурированность — нумерация, буллиты, много подзаголовков.

Посмотрите на этот список ещё раз. Почти каждый пункт — описание плохого, но человеческого академического текста. Формальная стилистика, общие фразы, ноль конкретики, красивая нумерация до третьего уровня — так пишут тысячи студентов, которые никакой нейросетью не пользовались. Отсюда и споры: разработчик утверждает, что вероятность ошибки не более 1%, а руководитель «Антиплагиата» Борис Тхориков настаивает, что ложное выявление не может достигать десятков процентов и случается только с небольшими участками. При этом исследования, на которые ссылается тот же материал, говорят, что надёжного алгоритма определения машинного текста в принципе не существует.

Масштаб разброса виден по статистике. Весной 2024 года подписчики проверили 3,2 миллиона работ, и почти 600 тысяч имели признаки машинной генерации — но доля таких работ по вузам колебалась от 2% до 58%. А по данным другого разбора, с 2022 по 2025 год доля текста, классифицированного как похожий на ИИ, выросла с 9,9% до 42,3%, причём максимум — во введениях и заключениях. Что логично: именно там больше всего шаблонных формулировок.

Какой процент нужен и кто на самом деле решает

Единого норматива нет, требования устанавливает вуз. По документам нескольких университетов, которые изучила «Парламентская газета», доля оригинальности диплома бакалавра должна быть не меньше 40%, магистра — не меньше 60%, аспиранта — не меньше 70%, а курсовой иногда достаточно четверти. В других обзорах приводят более строгий ориентир: 70–85% уникальности для дипломов и курсовых. Смотрите положение о ВКР на сайте своей кафедры, а не средние цифры из интернета.

Главное про статус отчёта: это не вердикт. Разработчик отдельно разъяснил, что результат — не оценка, а сигнал обратить внимание, и что функционала «допускать или не допускать к защите» у системы нет — задача остаётся за вузом и преподавателем. Преподаватели, в свою очередь, признают, что чётких критериев по нейросетям пока не существует, в отличие от заимствований, где прописаны и признаки, и допустимый процент.

Ещё одно изменение на горизонте: подход, при котором проверяют не готовый файл, а историю его создания. Как описывает эксперт Илья Русяев, «Антиплагиат 2.0» фиксирует вставки и копирование, время работы, черновые версии, источники вставленных фрагментов и обращения к нейросетям. Если студент сгенерировал раздел, а потом сам его переработал, в отчёте будут видны оба этапа. Вывод практический: писать диплом в одном документе, постепенно, с историей правок — становится выгоднее, чем вставлять готовый текст целиком за одну ночь.

Вопрос — ответ

Почему у меня 95% оригинальности, но красный флаг по ИИ?

Потому что это разные проверки. Сгенерированный текст уникален по определению — его нет ни в одной базе, и модуль заимствований его не видит. А детектор смотрит на стилистику: предсказуемые формулировки, общие фразы, отсутствие имён и дат. Высокий процент оригинальности такой флаг не отменяет.

Может ли детектор ошибиться на моём собственном тексте?

Может. Разработчик заявляет вероятность ошибки не более 1%, но исследования говорят, что надёжного алгоритма определения машинного текста не существует. Под подозрение чаще всего попадают введение и заключение — там больше всего шаблонных конструкций. Если уверены в своём тексте, обсуждайте отчёт с руководителем: решение принимает человек, а не система.

Спасёт ли перефразирование от антиплагиата?

Только от базового шинглирования. Модуль перефразирований сравнивает смысловые векторы предложений, а не совпадение слов, поэтому синонимы и перестановки он видит. Работает другое: собственные расчёты, свои примеры, данные по конкретному объекту исследования — то, чего в базах просто нет.

Как это решает кот

Мы в КотПишетСам обучили собственную модель писать учебные работы — не пересказывать чужие тексты, а собирать структуру, аргументацию и фактуру так, как это делает живой автор: с настоящими источниками, таблицами и оформлением по ГОСТ. Начать можно бесплатно: план работы по любой теме собирается за минуту, и уже по нему видно, какие главы придётся наполнять собственными данными, чтобы не упереться в проценты. Для текста, который выглядит слишком гладко и формально, есть встроенный и отдельный хьюманайзер, а логику обеих проверок — заимствований и ИИ-детекции — мы подробно разбираем в разборе. Финальное слово всё равно за вашим руководителем и кафедрой: система только расставляет флажки, а защищаете работу вы.

Источники — 8
  1. Т—Ж, 2026-05-08 — Студентов обвиняют в использовании ИИ при написании диплома открыть
  2. Антиплагиат, 2026-01-30 — Каждая пятая работа российских студентов имеет признаки ИИ открыть
  3. Habr, 2026-06-24 — Как работает проверка текста на ИИ в 2026 году открыть
  4. Правмир, 2026-06-10 — «Написал диплом с помощью ИИ». Как студенческие работы проверяют на плагиат открыть
  5. Парламентская газета, 2026-05-11 — «Антиплагиат» предложили проверить на точность выявления ИИ открыть
  6. Life.ru, 2026-09-15 — ИИ вычислят по следам: что изменится для студентов с «Антиплагиатом 2.0» открыть
  7. 100points.ru, 2026-09-09 — Как проверить оригинальность своего сочинения и не попасть под антиплагиат открыть
  8. Habr, 2026-05-13 — Как работают системы антиплагиата в 2026 году: шинглы и векторы открыть
Нужен план по своей теме? Кот соберёт цель, задачи и оглавление за минуту — бесплатно и без регистрации. Готовые работы с проверками — в примерах.

Читать дальше