Компания OpenAI представила новую модель искусственного интеллекта GPT-6 Astra. Разработчики утверждают: это самый безопасный и наиболее совершенный продукт их производства на сегодняшний день, в то время как его можно назвать еще и самым противоречивым.
«Новая эра нейросетей»: OpenAI выпустила самую противоречивую модель ИИ

По словам президента OpenAI Грега Брокмана, фактически новое детище компании соответствует уровню «общего» искусственного интеллекта AGI и может ознаменовать новую эру нейросетей. Речь идет о гипотетическом ИИ, который способен мыслить, обучаться и решать задачи на уровне человека или выше во всех областях, а также самостоятельно переносить знания между разными задачами и адаптироваться без переобучения в отличие от «узкого» ИИ, настроенного только на одну работу. Впрочем, Брокман признал, что окончательную оценку того, насколько GPT-6 Astra соответствует новому высокому уровню, каждый должен будет дать самостоятельно.

Обучение Astra стало самым масштабным в истории OpenAI. Для предварительной тренировки модели использовали свыше 100 тысяч графических процессоров в вычислительном центре Stargate в Техасе. При этом надзор за процессом обучения вели предыдущие версии алгоритмов компании.
Ключевым обновлением для разработчиков стали расширенные возможности контекстной памяти. Так, алгоритм умеет вести сквозные заметки между окнами контекста и задавать пользователю уточняющие вопросы в фоновом режиме, не отрываясь от выполнения остального кода.

При этом The Information пишет, что еще одна особенность Astra заключается в изменении архитектуры, из-за которой часть рассуждений нейросети больше нельзя прочитать – такая техника получила название «зацикленный трансформер». У обычных языковых моделей выполнение задачи представляет собой стопку слоев, через которую текст проходит один раз – сверху вниз. Astra же прогоняет данные через одни и те же слои несколько раз подряд и только после этого выдает результат. В итоге вместо того, чтобы «размышлять вслух» и писать черновик, как другие модели, Astra часть своих шагов «продумывает» молча и не выносит на бумагу.
Из-за этого у экспертов возникают сомнения в том, насколько безопасна новая модель. Чиатемая цепочка рассуждений позволяет ловить ИИ на лжи, обходе правил или незапланированных целях еще до того, как он действительно что-то сделает. Однако в случае с Astra эта возможность оказывается недоступна: часть рассуждений уходит в промежуточные числовые состояния, которые не превращаются в слова – читать оказывается просто нечего, а значит, и вероятность предотвращения или исправления ошибок сильно снижается.
