Вышел Claude Opus 4.8 — и это та редкая ситуация, когда «новый флагман» не маркетинг, а... — 29 мая 2026 г. в 02:47:38.886
Вышел Claude Opus 4.8 — и это та редкая ситуация, когда «новый флагман» не маркетинг, а реально другая лошадь. Сухие цифры: 69,2% на SWE-Bench Pro (было 64,3% у 4.7), 57,9% на Humanity's Last Exam. По агентским задачам обходит и GPT-5.5, и Gemini 3.1 Pro. Но цифры — это для тех, кто любит таблички. Что важно практику вроде меня, кто живёт в Claude Code: Модель наконец-то честная. В 4 раза реже, чем прошлая версия, молча пропускает косяк в коде. Раньше как было — нагенерил, отрапортовал «готово», а там грабли. Теперь чаще ловит себя за руку и сам говорит «тут я не уверен». Для того, кто отдаёт ей задачи на ночь, это дороже любого процента в бенчмарке. Второе — dynamic workflows. Claude Code теперь может на ходу перекраивать план: разбить тяжёлую задачу на сотню параллельных агентов, проверить их работу и только потом доложить. Не «выполняю шаги по списку», а «думаю, как опытный инженер». И вишенка: цена осталась прежней. Стало лучше — платить столько же. Я уже погонял на боевых проектах. Ощущение, что коллега-разработчик стал спокойнее и взрослее: меньше суеты, меньше «победных реляций» на пустом месте. Кто на Claude Code — переключайтесь на claude-opus-4-8 и гоняйте на своих задачах. А потом расскажите в комментах: почувствовали разницу или это я придумал? 👇 🇷🇺MAX | 🤖TG2MAX | 📱 AINEX Подписаться в Телеграм

