A AGI выйдет погулять? OpenAI сделала доступной ChatGPT Astra, но модель всех разочаровала

Нам обещали революцию, но получилась даже не эволюция.
Антон Попов
Антон Попов
A AGI выйдет погулять? OpenAI сделала доступной ChatGPT Astra, но модель всех разочаровала
Unsplash

Компания OpenAI открыла доступ к своей новейшей модели GPT-6 Astra для пользователей платных тарифов ChatGPT. О запуске объявил глава стартапа Сэм Альтман.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

В первую очередль модель дали пощупать обладателям планов Pro, Enterprise и Business Premium. Следом модель подключили подписчикам Plus и Business. Единственным платным тарифом за бортом остался базовый план Go. Но, вероятно, модель доберется и до этой подписки. Просто значительно позже. 

Astra интегрирована в инструменты Codex и ChatGPT Work. Лимиты зависят от уровня подписки:

Продолжение ниже Продолжение
  • Plus и Business: от 5 до 45 запросов каждые пять часов;
  • Pro: от 25 до 225 запросов за тот же период;
  • Pro с расширенной квотой (20x): до 900 запросов.
Соцсети
РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

В API доступ оценили в $10 за миллион входных токенов, $50 — за миллион сгенерированных и $1 — за миллион кэшированных. Звучит на уровне топов от Anthropic, но в OpenAI нам пообещали полноценный AGI, а значит качество должно быть кратно выше. Ведь так? Отнюдь.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Несмотря на заявления OpenAI о «революционном прорыве», первые результаты независимых испытаний оказались сдержанными (мягко говоря). Аналитическая компания Artificial Analysis протестировала систему по собственной открытой методологии и пришла к выводу, что в общем зачете новинка фактически повторяет показатели предыдущего флагмана.

В сводном индексе интеллекта (Intelligence Index) Astra заработала 61 балл — в точности как GPT-5.6 Sol. Для сравнения, Claude Fable 5.1 от Anthropic удерживает планку в 66 баллов, а Muse Spark 1.3 от Meta* (признана в России экстремистской организацией и запрещена) набрала 62 балла. Получается, что новая разработка OpenAI уступила ключевым конкурентам.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Сильнейшей стороной Astra остается программирование: в среде Codex на тестах агентного кодинга (Coding Agent Index) она показала результат в 67 баллов, встав в один ряд с Claude Opus 5 и базовой Fable 5 (первенство в этой дисциплине пока удерживает Fable 5.1 внутри Claude Code с 70 баллами).

Соцсети

В API новинка подорожала в 2,5 раза по сравнению с GPT-5.6 Sol. Рост тарифов разработчики попытались сбалансировать оптимизацией: Astra тратит примерно на треть меньше токенов при решении аналогичных задач. В комплексных сценариях программирования итоговая стоимость работы почти сравнялась с затратами на Sol. Однако в чистых логических и аналитических тестах выигрыш в расходе токенов минимален, из-за чего в пересчете на отдельную задачу Astra выходит на 75% дороже конкурентной Claude Fable 5.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ
РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ

Детальная раскладка по дисциплинам также показала смешанную картину:

  • Плюсы: число галлюцинаций в бенчмарке AA-Omniscience сократилось почти вдвое — с 92% до 51%; модель увереннее справляется с объемными проектами из тысяч файлов и слегка прибавила в математике.
  • Минусы: в наборе прикладных кейсов для 44 профессий Astra неожиданно просела, а в сценариях клиентской поддержки и анализа массивов документации потеряла по 2–3 балла относительно предшественницы.

В общем, AGI не случилось: GPT-6 Astra сделала ощутимый шаг вперед как специализированный инструмент для разработки ПО, но пока не смогла вернуть OpenAI безоговорочное лидерство в общем рассуждении и уступает текущей линейке Anthropic.

РЕКЛАМА – ПРОДОЛЖЕНИЕ НИЖЕ
Загружаем