GPT-6 Astra запустили, но результаты не впечатляют
GPT-6 Astra запустили, но результаты не впечатляют Пока OpenAI называет Astra революцией, Artificial Analysis прогнала её по своей открытой методике и охладила хайп. ▫️ В сводном Intelligence Index Astra набрала 61 балл. Столько же, сколько прежняя GPT-5.6 Sol. Для сравнения: Claude Fable 5.1 - 66 баллов, Meta (признана в России экстремистской и запрещена) Muse Spark 1.3 - 62. Где Astra реально сильнее? ▫️ В коде. В Coding Agent Index в среде Codex - 67 баллов, наравне с Claude Opus 5 и Fable 5. ▫️ Лидер тут по-прежнему Fable 5.1 в Claude Code с 70 баллами. Плюс модель расходует примерно треть токенов от прежней GPT-5.6 - значит, задачи по коду в максимуме выходят примерно как раньше, несмотря на подорожание. ▫️ А вот в задачах на «чистый интеллект» экономия скромнее. По пересчёту на задачу Astra получается на 75% дороже, чем Claude Fable 5. ▫️ Галлюцинации по тесту AA-Omniscience рухнули - с 92% до 51%. ▫️ Модель заметно прибавила в работе с проектами из тысяч файлов и в математике. Но в наборе практических задач для 44 профессий - просадка. В нескольких тестах, от клиентской поддержки до анализа больших документов, минус два-три балла. ▫️ В итоге, для кодинга Astra стала выгоднее. В общем интеллекте Anthropic не догнала. И это уже не первый релиз, где OpenAI обещает революцию, а независимые бенчмарки показывают, что она пока не случилась. Подписывайтесь на AI для бизнеса