Компания Anthropic — главный разработчик в сфере искусственного интеллекта, начала внедрять в ответы Claude скрытые водяные знаки. По сообщению издания Business Insider, эта маркировка не меняет смысл или читаемость контента, но сохраняется даже после копирования и редактирования фрагментов.
В Claude внедрили скрытые водяные знаки: теперь ИИ-контент станет проще определять?

Деталей работы технологии мы не знаем, однако все версии Claude, вышедшие после 2 августа, уже поддерживают эту функцию. А скоро разработчики планируют распространить технологию и на более ранние модели. Так что код и тексты, сгенерированные в Claude после 2 августа можно определить. По крайней мере, это могут делать в Anthropic , хотя в будущем компания намерена передать внешним организациям инструменты для распознавания этих знаков.
Компания Anthropic призвала остановить разработку ИИ. Критики считают, что это способ борьбы с конкурентами
Сооснователь Anthropic призвал ограничить развитие ИИ: он признал, что люди в опасности

Зачем нужны метки? ИИ-компании никогда не вводят системы водяных знаков просто так. Потому что это не очень хорошо с точки зрения клиентского опыта. Часть людей использует ИИ для того, чтобы нейросеть делала работу за них. Но человек не станет прибегать к услугам компании, которая прямо говорит — наш ИИ сделает работу за вас, но также сообщит всем, что вы воспользовались нашими услугами.
На самом деле, внедрение вотермарок — требования законодательства, либо же судебные иски. Например, популярный сервис для генерации музыки Suno внедряет вотермарки и радикально ухудшает качество песен из-за разборок с лейблами. А Anthropic — по требованию властей Европейского Союза. Скрытые метки помогут издателям и другим участникам рынка быстрее находить тексты, написанные нейросетями.
Вот только абсолютно неясно, как это будет работать. И будет ли работать вообще. Идея вотермарок в текстах полностью провалилась. Если делать их явными (скрытые символы или что-то подобное), то обойти ограничение можно просто копированием текста в блокнот с последующим сохранением.

Есть другие способы определять нейротекст. Так, современный ИИ не рассуждает, а лишь высчитывает, какое слово с большей вероятностью должно стоять следующим. Следовательно, текст, соответствующий паттернам ИИ (где каждое следующее слово имеет наибольший вес для ИИ), можно считать сгенерированным. Но даже такие проверки легко обходятся. Достаточно минимальной корректуры, без необходимости менять смысловое наполнение. Лишь порядок слов в предложениях.
Возможно, разработчики из Anthropic действительно смогли придумать нечто оригинальное, решить проблему, которая до этого никому не давалась. Но нам не верится. Куда вероятнее, что речь идет о формальном исполнении требований властей.
