Универсального способа поставить на нейросетевом тексте скрытую метку, которая позволила бы стопроцентно опознать его происхождение, пока не существует. Об этом в разговоре с «Газетой.Ru» рассказала AI/ML-инженер и специалист по большим языковым моделям Надежда Широглазова.
Универсального метода не существует: эксперт рассказал можно ли отличить ИИ-текст от написанного человеком

Эксперт объясняет: когда говорят о «метке ИИ», на деле имеют в виду разные вещи. Самый примитивный способ — спрятать в тексте служебные символы Unicode, например нестандартные пробелы или символы нулевой ширины. В них можно зашифровать какую-то информацию, но сам факт их присутствия ни о чем не говорит: это лишь технический прием, а не доказательство того, что текст создан нейросетью. К тому же, опытный человек легко отыщет такие метки и вычистит их из текста, поэтому доверять способу точно нельзя.
«Мы утратим над ним контроль»: почему создатели искусственного интеллекта требуют замедлить его развитие
Искусственный интеллект отправят в космос: Илон Маск начнет запускать суперкомпьютеры Nvidia уже в 2027 году

Еще один вариант — метаданные самого файла. В PDF или DOCX иногда остаются сведения о программе, в которой документ был создан, или история правок. Но это данные о файле, а не о содержании: стоит скопировать текст в другой документ, и след, как правило, теряется.
Самая сложная и одновременно самая интересная технология — статистический водяной знак. Широглазова описывает принцип так: нейросеть генерирует текст пословно, каждый раз выбирая одно слово из нескольких подходящих. Алгоритм ватермаркинга слегка смещает этот выбор в определенную сторону, из-за чего в тексте складывается статистическая закономерность — ее можно найти, но только имея специальный ключ. Такой способ, к слову, использует Anthropic. Компания маркирует сгенерированные тексты таким образом, хотя и отмечает, что гарантий на точное распознавание дать не может.

А если инструментов для «дешифрации» нет, то и отличить текст не получится. Но даже если на руках есть инструмент, позволяющий отличить ИИ-текст, опытный специалист легко обойдет ограничения. Достаточно просто переформулировать, перевести на другой язык, а после обратно. И вот уже на руках оригинальный текст, написанный человеком.
Поэтому эксперт советует не слишком доверять публичным AI-детекторам. Работают они иначе: оценивают стиль, предсказуемость слов, структуру предложений — и выдают процент вроде «85% вероятности, что текст написан ИИ». Но это не доказательство, а лишь статистическая догадка, основанная на косвенных признаках.
«Универсального способа сделать нейросетевой текст гарантированно нераспознаваемым сегодня нет, а любой итоговый материал после использования AI-инструментов необходимо самостоятельно перечитывать и проверять», — заявила Широглазова.
