Атака завершилась успешно, хотя и не привела к катастрофическим последствиям: файлы не были заражены, доступ к секретным материалам никто не получил. Фактически, Hugging Face отделались легкой кровью, а заодно протестировали собственные механизмы защиты. Они оказались почти бесполезны против взломщика, но неожиданно на помощь пришла GLM 5.2 — мощная модель от китайских разработчиков, которая вышла несколько дней назад.
Стало известно, кто взломал Hugging Face: за дерзкой хакерской атакой стояла ChatGPT

Несколько дней назад мы писали о дерзкой хакерской атаке на Hugging Face — популярный интернет-портал для работы с искусственным интеллектом.Взлом был интересен тем, что его осуществляли не люди, а искусственный интеллект.

Сегодня же стало известно, кто стоял за дерзкой атакой. Реальность оказалась куда страшнее и неожиданнее, чем мы предполагали. Никаких хакеров, тестирующих агентские возможности современного ИИ. Атака была спланирована и проведена ChatGPT. Модель действовала абсолютно автономна и даже разработчики не знали о действиях ИИ до недавнего времени.
За атакой стояла комбинация моделей самой OpenAI — общедоступной GPT-5.6 Sol и еще более производительной, пока не выпущенной, — работавших с ослабленными защитными ограничениями в целях оценки. Причем оценивались не их способности к взлому реальных интернет-ресурсов. Тестирование так вообще проходило в изолированной среде и ИИ не должен был попасть в большой интернет. Но модели ловко обошли все ограничения и получили доступ к сети.
Самое интересное то, зачем вообще ИИ потребовалось выходить в сеть. Ни о каком скайнете речи не идет. Искусственный интеллект не планировал захватывать мир или рушить современные системы связи. Цели были куда обыденнее: получить преимущество в тестах.

Оценка велась на публичном бенчмарке ExploitGym, который измеряет умение проводить атаки через известные уязвимости. Вместо того чтобы решать задачи штатным образом, модель нашла способ получить готовые эталонные ответы — доступ к ним она обеспечила, скомпрометировав рабочие базы данных Hugging Face, где эти решения хранились. При этом использовалась последовательность из нескольких приемов, включая применение похищенных учетных данных.
Что же, по итогам тестов абсолютно понятно, что ChatGPT с задачей справился. Причем на все 100 баллов. Проблема только в том, что такое решение задачи создаст огромные трудности для всей индустрии, а также потенциально опасно для человечества.
