Перейти к содержимому
DCDiplomCraft
Заказать реферат →
Антиплагиат8 мин

Детектор ИИ отметил текст: как читать результат, если текст свой

Детектор ИИ оценивает стиль текста, а не то, кто его написал, поэтому определения, методика и введение по шаблону иногда получают пометку и в самостоятельной работе. Цифра в отчёте бывает долей размеченного текста, вероятностью или стилевым баллом, а решение по работе принимает человек по правилам вуза. Если текст ваш, попросите список помеченных фрагментов и покажите историю версий, черновики и расчёты.

Автор: Редакция DiplomCraftОпубликовано: Обновлено:

Отчёт с пометкой «сгенерировано ИИ» пугает сильнее, чем низкая оригинальность: непонятно, с чем спорить. Особенно если работа написана своими руками, с черновиками и бессонными ночами. Разбираем, что на самом деле измеряет детектор, какие цифры бывают в отчётах, почему своему тексту достаётся пометка и как спокойно показать, что автор вы.

Что измеряет детектор ИИ

Детектор не знает, кто писал текст. Он не видел, как вы сидели над второй главой, и не сравнивает работу с вашей перепиской в чат-боте. У него есть только сам текст, и по нему он оценивает, насколько тот похож на типичный вывод языковой модели.

Похожесть считается по статистическим признакам. Модель выбирает самые ожидаемые слова, поэтому её текст предсказуем. Предложения у неё близкой длины, связки повторяются, абзацы построены по одной схеме. Человек пишет неровнее: одно предложение на три слова, следующее на полстроки, где-то оговорка, где-то резкий вывод. Детектор ищет такие следы и выдаёт оценку.

Отсюда главное ограничение. Оценка вероятностная и описывает стиль, а не происхождение текста. Сухой, аккуратный, грамотный текст бывает похож на машинный, даже если каждое слово в нём ваше. Показательная история: OpenAI в 2023 году закрыла собственный классификатор сгенерированного текста и объяснила это его низкой точностью. Если разработчик модели не взялся надёжно отличать её текст от человеческого, к цифре любого детектора стоит относиться как к сигналу, а не к доказательству.

Как преподаватели используют такие проверки и что замечают без всяких сервисов, разобрано в статье о том, как проверяют работы на ИИ.

Доля, вероятность, балл: какая цифра перед вами

Разные системы показывают результат по-разному, и путаница начинается именно здесь. Прежде чем пугаться числа, выясните, что оно означает:

Что показаноКак читатьЧего это не значит
Доля текста с признаками генерацииКакая часть работы размечена как похожая на сгенерированную, обычно с подсветкой фрагментовЧто эту часть написала нейросеть: это оценка стиля помеченных абзацев
Вероятность для всего текстаНасколько модель детектора уверена, что текст в целом похож на машинныйЧто определённая доля работы написана ИИ; на коротком тексте такая оценка особенно шаткая
Стилевой баллНасколько выражены отдельные признаки: фразы без имён и документов, шаблонные оборотыВероятности авторства: балл показывает, что переписать, а не кто писал
Разметка фрагментовКакие абзацы вызвали подозрениеЧто остальной текст проверен и признан человеческим

В Антиплагиат.ВУЗ разметка сгенерированного текста появляется в отчёте, если вуз подключил соответствующий модуль. Как устроена эта часть отчёта, описано в статье о модуле детекции ИИ. Для чтения результата важно другое: цифра в отчёте и решение по работе не одно и то же. Решение принимает человек, а правила задаёт вуз.

Две системы на одном тексте легко дают разные цифры. Это не значит, что одна из них сломана: у них разные модели, признаки и пороги. Сравнивать результаты разных сервисов между собой бессмысленно. Сравнивать можно только версии своего текста в одной и той же системе.

Даже одна система не обязана выдавать одно и то же. Разработчики обновляют модели, и через месяц тот же файл может получить другую разметку. На результат влияет и длина: по короткому фрагменту статистике не на что опереться, поэтому оценка абзаца надёжна меньше, чем оценка главы. Если вы проверяли работу сами и получили одну цифру, а в вузе увидели другую, это нормально и само по себе ничего не доказывает.

Почему свой текст получает пометку

Ложное срабатывание не редкость и не заговор. Чаще всего под подозрение попадают фрагменты, которые и человек пишет по шаблону:

  • Определения и обзор теории. Когда пересказываешь учебник нейтральным языком, текст выходит гладким и предсказуемым.
  • Методика и нормативная часть. Формулировки вроде «в соответствии со статьёй…» у всех одинаковые, написать их иначе трудно.
  • Введение по методичке. Цель, задачи, объект и предмет строятся по жёсткой схеме, и эта схема похожа на то, что выдаёт модель.
  • Текст после сервисов правки. Автоматическая корректура выравнивает пунктуацию и стиль, убирая шероховатости, которые детектор считает человеческими.
  • Очень ровный авторский стиль. Некоторые люди пишут аккуратно и однообразно, так их научили в школе.

Отдельный случай составляют перечисления и списки. Задачи исследования, этапы анализа, пункты рекомендаций пишутся однотипными оборотами: «изучить…», «проанализировать…», «разработать…». Для детектора это ровный ритм и повторяющиеся конструкции, хотя по-другому такие списки почти не пишут.

Бывает и так: студент писал сам, но опирался на материалы, которые кто-то сгенерировал. Статья-пересказ с сомнительного сайта могла быть написана моделью, и её обороты перекочевали в ваш текст. Проверьте, откуда взялись помеченные абзацы, прежде чем что-то доказывать.

Что делать, если помечен ваш текст

Не переписывайте всё подряд в панике. Работа, прогнанная через десяток синонимайзеров, читается хуже исходной и вызывает больше вопросов. Спокойный порядок действий такой:

  1. Узнайте, кто и какой системой проверял. Отчёт Антиплагиат.ВУЗ, распечатка стороннего сервиса и устное «мне кажется» требуют разных ответов.
  2. Попросите отчёт или хотя бы список помеченных фрагментов. Спорить с общей цифрой невозможно, с конкретным абзацем можно.
  3. Найдите правила вуза. Как учитывается пометка о сгенерированном тексте, написано в положении о ВКР или о проверке работ, иногда в методичке. Пометка может стать поводом для беседы, основанием вернуть работу на доработку или не иметь последствий: это решает вуз.
  4. Соберите подтверждения авторства, о них ниже.
  5. Перечитайте помеченные абзацы. Если в них правда одни общие слова без ссылок и конкретики, доработайте их. Не ради детектора, а потому что такой текст слабее.

Чем подтвердить авторство

Лучшее доказательство того, что текст ваш, это следы работы над ним. Их обычно больше, чем кажется:

Что показатьГде взятьО чём это говорит
История версий файлаЖурнал версий Google Документов, версии файла в OneDrive или на Яндекс Диске, автосохранения WordТекст рос постепенно, с правками, а не появился целиком
Черновики и планыРанние файлы, план, согласованный с руководителем, заметки на бумагеСтруктура работы складывалась по ходу
Выписки и конспектыЦитаты с номерами страниц, закладки в PDF, фото страниц книгВы читали источники, на которые ссылаетесь
Расчёты и данныеФайлы Excel, исходные данные организации, выгрузки отчётностиЦифры практической части получены вами
Переписка с руководителемПисьма и сообщения с замечаниями и вашими исправлениямиРабота проходила через руководителя по ходу написания

Самое сильное подтверждение при этом не файл, а разговор. Если вы свободно объясняете, почему выбрали методику, откуда цифра в таблице и что имели в виду в спорном абзаце, это убеждает сильнее любого отчёта. Перед встречей перечитайте работу, особенно помеченные места и расчёты.

На будущее: пишите в сервисе, который хранит историю версий, и не удаляйте черновики до защиты. Это ничего не стоит, а в спорной ситуации бережёт нервы.

Как говорить с преподавателем

Тон важнее аргументов. Фраза «детекторы ничего не понимают» звучит как оборона, даже если вы правы. Лучше предложить конкретное: показать историю версий, пройтись по помеченным абзацам, ответить на вопросы по содержанию.

Первое сообщение руководителю может быть коротким. Условный пример:

Здравствуйте! В отчёте о проверке моей курсовой часть текста размечена как сгенерированная. Работу я писал сам, могу показать историю версий файла, черновики и таблицы с расчётами. Подскажите, пожалуйста, какие фрагменты вызвали вопросы и когда удобно их обсудить?

В таком письме нет спора с системой, зато есть готовность показать материалы. Руководителю проще разобраться, когда студент приходит с файлами, а не с возмущением.

Если вы использовали нейросеть для вспомогательных задач, скажите об этом сразу и объясните, что именно она делала: подбирала ключевые слова для поиска литературы, проверяла орфографию, помогала с переводом. Правила о допустимом использовании ИИ у вузов разные, и честное описание лучше умолчания, которое потом обнаружится. Где вуз записывает такие правила, разобрано в статье о нейросети в ВКР.

Если договориться с преподавателем не получилось, узнайте порядок обжалования в своём вузе: к кому обращаться и в какие сроки. Он тоже записан в локальных документах.

Как посмотреть на работу до сдачи

Проверка перед сдачей нужна не для того, чтобы подогнать текст под цифру. Её задача найти абзацы, которые и читателю покажутся пустыми. Бесплатный стилевой индикатор считает балл от 0 до 100 по двум признакам: фразы без имён и документов и шаблонные обороты. Он работает в браузере и никуда не отправляет текст. Это не вероятность авторства и не прогноз вузовской проверки, индикатор просто показывает места, где тексту не хватает конкретики.

Помеченное место правится конкретикой: пример из вашей организации, цифра из анализа, ссылка на страницу источника, собственная оценка. Фразы вроде «данный вопрос является актуальным» лучше заменить или убрать.

Если часть работы вы набросали с помощью нейросети и правила вуза это допускают, черновик нужно переработать так, чтобы он стал вашим текстом, а само использование раскрыть так, как требует вуз. Для больших объёмов есть гуманизатор: он переписывает шаблонные обороты и ровный ритм в файле .docx и стоит 25 ₽ за страницу. Результат внешней проверки он не гарантирует, итог всё равно нужно вычитать. Собственному тексту, помеченному по ошибке, он не нужен: там работают подтверждения авторства, а не переписывание.

Если работа только предстоит, а времени мало, посмотрите условия курсовой на заказ: план показывается до оплаты, а текст приходит редактируемым файлом, который вы дорабатываете сами. Правила вашего вуза об ИИ действуют и для такой работы, поэтому узнайте их заранее.

Нужна курсовая, а времени мало? DiplomCraft покажет план до оплаты, текст придёт редактируемым .docx. Правила вашего вуза об ИИ и самостоятельности работы уточните заранее.

Получить план курсовой

Часто задаваемые вопросы

Может ли детектор ИИ ошибиться, если текст написан самостоятельно?
Да. Детектор оценивает стиль, а не происхождение текста: ровный, грамотный, построенный по схеме текст бывает похож на машинный. Чаще всего под подозрение попадают определения, обзор теории, методика и введение по методичке. Пометка – сигнал для проверки, а не доказательство.
Что значит процент ИИ в отчёте о проверке?
Чаще всего это доля текста, которую система разметила как похожую на сгенерированную. Она не означает, что эту часть написала нейросеть. В других сервисах цифра бывает вероятностью для всего текста или стилевым баллом, поэтому сначала уточните, что именно показано.
Как доказать, что работу писал я сам?
Покажите историю версий файла, черновики, конспекты с номерами страниц, расчёты и переписку с руководителем. Самый сильный аргумент – разговор по содержанию: объясните выбор методики, происхождение цифр и смысл помеченных абзацев.
Сколько процентов ИИ допустимо в курсовой или ВКР?
Единого норматива нет. Если вуз учитывает разметку сгенерированного текста, правила записаны в его положении о проверке работ, о ВКР или в методичке. Узнайте их у руководителя, а не на форумах.
Помогает ли переписать помеченный текст синонимами?
Нет. Механическая замена слов портит текст и не делает его более вашим. Если абзац действительно пустой, добавьте конкретику: данные, пример, ссылку на страницу источника, свою оценку. Если текст ваш и написан нормально, подтверждайте авторство, а не переписывайте его.