Универсального метода не существует: эксперт рассказал можно ли отличить ИИ-текст от написанного человеком

Надежного способа не существует.
Антон Попов
Антон Попов
Универсального метода не существует: эксперт рассказал можно ли отличить ИИ-текст от написанного человеком
Unsplash

Универсального способа поставить на нейросетевом тексте скрытую метку, которая позволила бы стопроцентно опознать его происхождение, пока не существует. Об этом в разговоре с «Газетой.Ru» рассказала AI/ML-инженер и специалист по большим языковым моделям Надежда Широглазова.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Эксперт объясняет: когда говорят о «метке ИИ», на деле имеют в виду разные вещи. Самый примитивный способ — спрятать в тексте служебные символы Unicode, например нестандартные пробелы или символы нулевой ширины. В них можно зашифровать какую-то информацию, но сам факт их присутствия ни о чем не говорит: это лишь технический прием, а не доказательство того, что текст создан нейросетью. К тому же, опытный человек легко отыщет такие метки и вычистит их из текста, поэтому доверять способу точно нельзя.

Unsplash
Продолжение ниже Продолжение
РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Еще один вариант — метаданные самого файла. В PDF или DOCX иногда остаются сведения о программе, в которой документ был создан, или история правок. Но это данные о файле, а не о содержании: стоит скопировать текст в другой документ, и след, как правило, теряется.

Самая сложная и одновременно самая интересная технология — статистический водяной знак. Широглазова описывает принцип так: нейросеть генерирует текст пословно, каждый раз выбирая одно слово из нескольких подходящих. Алгоритм ватермаркинга слегка смещает этот выбор в определенную сторону, из-за чего в тексте складывается статистическая закономерность — ее можно найти, но только имея специальный ключ. Такой способ, к слову, использует Anthropic. Компания маркирует сгенерированные тексты таким образом, хотя и отмечает, что гарантий на точное распознавание дать не может.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ
Unsplash

А если инструментов для «дешифрации» нет, то и отличить текст не получится. Но даже если на руках есть инструмент, позволяющий отличить ИИ-текст, опытный специалист легко обойдет ограничения. Достаточно просто переформулировать, перевести на другой язык, а после обратно. И вот уже на руках оригинальный текст, написанный человеком.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Поэтому эксперт советует не слишком доверять публичным AI-детекторам. Работают они иначе: оценивают стиль, предсказуемость слов, структуру предложений — и выдают процент вроде «85% вероятности, что текст написан ИИ». Но это не доказательство, а лишь статистическая догадка, основанная на косвенных признаках.

«Универсального способа сделать нейросетевой текст гарантированно нераспознаваемым сегодня нет, а любой итоговый материал после использования AI-инструментов необходимо самостоятельно перечитывать и проверять», — заявила Широглазова.

Загружаем