Что такое генеративный текст, можно спросить у GPT. Антиплагиат ВУЗ, равно как и OpenAI не умеют выявлять генеративность. Отличие между этими двумя коммерческими структурами в том, что OpenAI открыто в этом призналась.
Итак, не один детектор генеративности никогда не умел находить генеративные тексты. После гордого заявления антиплагита все стали свидетелями бесчисленных глюков проверок, например, пустой лист — генеративен, содержание, нумерация страниц, подстрочные ссылки и даже святая святых, библиографический список, все они могли оказаться генеративными.
Антиплагиат, объявивший весной 2023 г. о бета-детекторе, спустя год не вышел в альфу и не стал рабочим модулем. Поспешив включить детектор генеративных текстов в состав базовых модулей, антиплагиат вызвал увеличение количества проверок пользователей, каждый раз доказывая, что это «экспертная» система.
В Интернете много «мутных» публикаций о том, что отличает генеративный текст от человеческого, пишут о водяных знаках, встроенных кодах, которые оставляют цифровые следы и т. д. Исходя из аксиомы, которую озвучила OpenAI, все это не представляет когнитивного интереса, потому что генеративные тексты сегодня не определяются и не будут определяться в будущем. Следовательно, все Интернет-домыслы — это фантазии на тему поиска блохи в стоге сена.
Переходя в практическую плоскость, обратимся к статусу — «Внимание, документ подозрительный: в документе присутствует сгенерированный текст», который антиплагиат навешивает налево и направо. Этот статус подразумевает, что текст, который проверен в антиплагиат ВУЗ — генеративный, другими словами написанный искусственным интеллектом (GPT, ChatGPT). Исходя из аксиомы от OpenAI, проблема не в том, как сделать генеративный текст человеческим, а в том, как преодолеть бета-новацию антиплагиата, который ВУЗ.
Мы уже писали, что представительная группа студентов, вообразили себя гуру, которые овладели GPT, поэтому мощную систему, называемую искусственным интеллектом, начали использовать как расширенную версию поисковика. Примитивные запросы к GPT, ChatGPT породили примитивные тексты, которые антиплагиат ру заслуженно метит как генеративные.
Давайте начнем сначала — тексты, сгенерированные GPT, ChatGPT сегодня не может определить ни один детектор. Поэтому GPT и ChatGPT могут успешно использоваться при написании научных работ, а также для очеловечивания текстов.
Волшебное слово, которое нужно употреблять вовремя GPT-запросов, это конкретизация того, что вы хотите получить.
Приведем несколько примеров излечивания GPT-текстов. Дан текст, написанный человеком: «Деструктивный нарциссизм, как патологическое искажение конструктивного нарциссизма, означает искажение или нарушение способности личности реалистично воспринимать, ощущать и оценивать себя; нестабильность отношения к себе, проявляющаяся колебаниями идей собственной переоценки и недооценки с невозможностью стабилизации отношения к себе вследствие невозможности объективизировать его в „зеркале“ межличностного взаимодействия [1, С. 45]. Деструктивно-нарциссическая личность характеризуется неадекватно-противоречивой оценкой себя, своих действий, способностей и возможностей, низкой толерантностью к фрустрациям (стрессоустойчивостью); искаженным восприятием других, крайней обидчивостью, чрезмерной осторожностью, закрытостью, тенденцией постоянно контролировать собственную экспрессию, и трудностями в общении, ощущением неразделенности и непонятности другими субъективно важных переживаний, чувств, интересов и мыслей, высокой потребности в общественном признании [14, С. 62—64]».
Проверка в GPTZero, показывает, что текст на 48% генеративный, рис. 59, openai-openai-detector. hf. space считает этот текст фейковым, генеративным на 81%, рис. 60.

Рисунок 59 — Проверка текста, написанного человеком в GPTZero

Рисунок 60 — Проверка текста, написанного человеком в openai-detector
Этот эксперимент показывает, что человеческий текст крайне неубедительно детектируется как текст, написанный человеком, в нашем примере, рис. 59 и 60, детекторы классифицируют текст, написанный человеком, как генеративный.
Выше мы сгенерировали рерайт текста, Приложение 3, проверим его на генеративность, рис. 61.

Рисунок 61 — Проверка текста GPT-рерайта в GPTZero
Как видно из рис. 61, по версии GPTZero, после обработки текста в ChatGPT, его человечность повысилась и стала равна 50%, искусственного интеллекта, генеративности, в данном тексте 34%.
Давайте проведем эксперимент, сгенерируем текст на русском языке, рис. 62.

Рисунок 62 — Генерация текста примитивным промптом-инструкцией
Данный текст проверим на генеративность, рис. 63.

Рисунок 63 — Детектирование генеративности в openai-detector
Как видно из рисунка 63, в генеративном тексте генеративности столько же как и в человеческом тексте, с разницей в 4%.
Переведем текст на английский язык с помощью переводчика, в котором не используется ИИ, это старый, отечественный ПРОМТ, рис. 65.

Рисунок 64 — Перевод текста на английский язык в PROMT 20
Полученный английский текст проверим на генеративность, рис. 65.

Рисунок 65 — Проверка английского текста после перевода в PROMT сервисом openai-detector
Ситуация кардинально поменялась, наш текст очеловечился с заметным отрывом.
Исходя из полученных результатов проведем эксперимент с генеративным текстом, рис. 66.

Рисунок 66 — Ответ GPT на примитивную инструкцию «Сгенерируй текст…»
GPT тексты грешат маркированными списками, в которых «зашита» тавтология, несмотря на это, по версии GPTZero наш текст считается человеческим на 69%, рис. 67.

Рисунок 67 — Детектирование текста в GPTZero
Переведём наш генеративный текст на английский и применим к нему промпт, который применяли для рерйта, полученный текст проверим еще раз, рис. 68.

Рисунок 68 — Детектирование текста в GPTZero после применения GPT и переводчика Google
Как видно GPTZero считает этот текст человеческим на 81%, только 9% содержания текста отнесены к генеративному. Напомню, что выше мы тестировали текст, написанный человеком, GPTZero нашел в нем 48% генеративного текста, однако, текст, который мы сгенерировали показал всего 18% генеративности, а после рерйта — 9% генеративности.
Что делать с генеративным текстом, спросите у GPT, какой текст считается генеративным, какие маркеры отвечают за детектирование ИИ в тексте, см. п 4.1.
Генеративные тексты характеризуются — однообразием, все предложения составляются по одному шаблону; это формализованные тексты, т.к. их пишет машина, а не человек; ИИ тексты грешат тавтологией и отсутствием анализа, и доказательностью.
Стоит ли проверять свои тексты в сервисах детектирования, отличных от антиплагиат, версии ВУЗ — нет, не стоит, т.к. все сервисы используют разные алгоритмы и результирующе показатели не валидны антиплагиат ВУЗ.