Перейти к основному содержимому

Антиплагиат показал ИИ, хотя я писал сам: что делать?

25 сентября 20266 мин. чтения
Антиплагиат показал ИИ, хотя я писал сам: что делать?

Если система проверки на плагиат обвинила вас в использовании нейросетей, хотя вы всё писали сами, не паникуйте. Это новая и пока неидеальная технология. Детекторы ИИ ищут в тексте статистические «отпечатки», характерные для сгенерированного контента, и могут ошибаться, принимая за них слишком формальный или гладкий авторский стиль. Ни один детектор не точен на 100 %. Чтобы доказать свою правоту, сохраняйте черновики и историю правок. Помните: по закону авторское право на вашу работу возникает в момент её создания и не требует регистрации.

Как детекторы ИИ вообще распознают текст и насколько они точны?

Представьте, что детектор — это не филолог, а статистик. Он не «понимает» смысл, а ищет в тексте математические закономерности, которые характерны для нейросетей. Точность таких систем пока далека от идеала, и результат проверки: это скорее вероятность, а не окончательный вердикт. Система оценивает текст по нескольким параметрам, и если они совпадают с паттернами ИИ, вы получаете «красный флажок».

В отличие от обычной проверки на плагиат, которая ищет прямые заимствования, детекторы ИИ анализируют структуру текста. Они смотрят на предсказуемость фраз, однородность лексики, плавность переходов и отсутствие авторского «голоса». Нейросети учатся на гигантских объёмах данных и стремятся создавать максимально усреднённый, «безопасный» текст. Если ваш стиль письма случайно оказался похожим на этот усреднённый стандарт, система может ошибиться. Это случается.

Точность — больное место всех детекторов. Исследования показывают, что даже лучшие из них не дают стопроцентной гарантии. Например, один из передовых сервисов, Copyleaks, для английского языка ошибается лишь в 3,8 % случаев, но для русского его заявленная точность составляет около 89 %. Это значит, что каждый десятый вердикт может быть неверным. Поэтому разработчики и сами предупреждают: их отчёты не должны быть единственным основанием для принятия серьёзных решений.

Почему «Антиплагиат» мог посчитать мой текст сгенерированным?

Скорее всего, потому что вы пишете слишком правильно. Да, серьёзно. Детекторы ИИ, особенно новые и ещё «сырые», как в системе «Антиплагиат», часто принимают за машинный текст очень формальный, стилистически ровный язык без ярких авторских черт. Если в вашей работе много шаблонных фраз, канцеляризмов и гладких переходов, алгоритм может распознать в этом знакомые ему паттерны.

Именно из-за этого и возникает парадокс: чем строже вы следуете академическим нормам и стараетесь писать «как положено», тем выше риск получить ложное обвинение. Система ищет следы, оставленные языковыми моделями вроде GPT, и если ваш стиль письма случайно их имитирует, ждите проблем. Разработчики «Антиплагиата» сами признают, что функция новая и дорабатывается.

Прецедент создал студент РГГУ Александр Жадан, написавший диплом с помощью ChatGPT. Сначала уникальность была 0,07 %, но после нескольких итераций редактирования (тоже с помощью ИИ) он поднял её до 94,89 % и успешно обошёл проверку. Это доказывает две вещи: система не всесильна, а даже чисто машинный текст можно «очеловечить».

Эта проблема будет только усугубляться. Появится условный GPT-5, который будет писать ещё более «человечно». Чтобы его поймать, детекторы придётся сделать ещё строже. А это неизбежно приведёт к росту ложных срабатываний, когда под подозрение начнут попадать и добросовестные авторы.

Как доказать, что это я написал текст?

Хорошая новость: по закону вы, как автор, изначально правы. Авторское право на произведение возникает в момент его создания и не требует никакой регистрации. Это закреплено и в Бернской конвенции, и в российском законодательстве. Но в спорной ситуации одних слов будет мало, понадобятся доказательства.

Самый надёжный способ — доказать «приоритет времени». То есть показать, что ваша работа существовала в определённый момент времени под вашим именем. Для этого есть несколько практических шагов. Сохраняйте все черновики, промежуточные версии, скриншоты процесса работы, переписку с научным руководителем или коллегами. Всё это может стать вашим алиби.

Для более серьёзной защиты можно прибегнуть к депонированию. Это процедура, при которой вы передаёте экземпляр своей работы на хранение в специальную организацию, а взамен получаете сертификат с датой. Такой документ является весомым аргументом в любом споре об авторстве. В России такие услуги предоставляют как частные компании, так и авторские общества.

Что не поможет в спореЧто действительно работает
Эмоциональные заявленияСохранение всех черновиков и версий файла
Надеяться на честное словоДепонирование работы в специальном сервисе
Удалять все промежуточные файлыФиксация даты через нотариуса или отправку себе письма
Утверждать, что «все так делают»Наличие свидетелей (научный руководитель, редактор)

Простой «дедовский» способ зафиксировать дату: отправить самому себе заказное письмо с распечаткой текста. Не вскрывайте конверт. В случае спора почтовый штемпель на нём станет доказательством того, что на определённую дату этот текст у вас уже был.

Согласно статье 1265 Гражданского кодекса РФ, право авторства неотчуждаемо. Это значит, что никто не может лишить вас права считаться создателем вашего произведения.

Что будет с авторством и проверками в будущем?

Нас ждёт увлекательная гонка технологий. Нейросети будут писать всё более неотличимо от человека, а детекторы будут становиться всё хитрее. Вероятно, фокус проверок сместится с простого «ИИ или не ИИ?» на более глубокий анализ. Помимо стиля, будущие системы будут оценивать логическую связность, оригинальность идей и наличие «семантического дрифта», свойственного машинам плавающего смысла.

«Новый функционал включён в стандартную лицензию на проверку на обнаружение заимствований. Система проверки анализирует текст на наличие фрагментов, которые с высокой вероятностью созданы с использованием моделей глубокого обучения GPT-2, GPT-3, ChatGPT. Детектор машинно-сгенерированных текстов обучен и протестирован на большом наборе данных, что снижает риск ложноположительного срабатывания», — говорит Юрий Чехович, руководитель компании «Антиплагиат».

Уже сейчас появляются продвинутые алгоритмы. Например, GPTZero строит «карты семантической cohérentности» (согласованности), чтобы отследить, насколько логично одна мысль вытекает из другой. Это уже не просто статистика, а попытка заглянуть в «мозг» текста.

Возможно, со временем мы придём к тому, что важен будет не столько факт использования ИИ, сколько то, как он использован. Если нейросеть, это инструмент для генерации идей и черновой работы, а финальный текст осмыслен и создан человеком, то в чём проблема? Границы авторства станут более размытыми.

Так что расслабляться не стоит. Умения писать теперь недостаточно: важно также быть готовым доказать своё авторство в этом новом мире. Сохраняйте черновики, знайте свои права и помните: пока что человек-редактор и здравый смысл всё ещё надёжнее любого алгоритма.

Часто задаваемые вопросы

Как работают детекторы ИИ?

Детекторы анализируют текст не на смысл, а на статистические характеристики: равномерность длины предложений, предсказуемость лексики, отсутствие стилистических «всплесков». Нейросети обычно пишут очень гладко и однородно. Если авторский стиль похож на этот «усреднённый» стандарт, система может ошибочно пометить его как сгенерированный.

Почему мой текст, написанный вручную, сочли сгенерированным?

Самая частая причина — слишком формальный, «правильный» или шаблонный язык. Академический стиль с его клише, канцеляризмами и сложными конструкциями может быть похож на то, что генерирует нейросеть, обученная на миллионах научных статей. Алгоритм видит знакомые паттерны и бьёт тревогу.

Какие признаки чаще всего указывают на текст от ИИ?

Это: предсказуемая структура (введение, три пункта, заключение), злоупотребление общими фразами, отсутствие личного мнения или уникальных примеров, а также идеально ровный, «причёсанный» стиль без авторских шероховатостей. Такой текст выглядит слишком гладким, почти стерильным, в нём нет живого голоса.

Можно ли «очеловечить» текст от нейросети, чтобы он прошёл детекторы?

Да, и это доказывает случай студента Александра Жадана с его дипломом. Для этого нужно разбить шаблонную структуру, добавить авторские обороты, личные примеры, эмоции, возможно, даже намеренно внести стилистические неровности. По сути, нужно превратить «среднестатистический» текст в уникальный авторский продукт.

Как доказать своё авторство, если работу посчитали сгенерированной?

Лучшие доказательства: это черновики, промежуточные версии файла с историей правок, переписка с научным руководителем, где вы обсуждали работу. Для стопроцентной гарантии можно использовать депонирование: передачу копии на хранение с получением сертификата, подтверждающего дату и ваше имя.

Насколько точны детекторы ИИ и можно ли им полностью доверять?

Нет, доверять им полностью нельзя. Ни один из существующих детекторов не даёт 100 % точности. Их результаты следует рассматривать как рекомендацию или повод для более детального изучения текста, но не как окончательный приговор. Всегда остаётся вероятность ложного срабатывания в обе стороны.

Если вы пишете академическую работу и хотите, чтобы ИИ был вашим умным помощником, а не проблемой при проверке, попробуйте Помощник аспиранта referati.ai, сервис, созданный специально для научного и академического письма на русском языке.

Готов написать свою работу?

Referati AI поможет тебе найти источники, составить план, написать черновик и оформить цитаты за минуты.

Читайте также