Любопытно, Anthropic только что сделали то, что до этого никому не давалось: Claude Opu... — 4 июня 2026 г. в 07:10:49.136
Любопытно, Anthropic только что сделали то, что до этого никому не давалось: Claude Opus 4.8 занял первое место в ARC-AGI-3 – самом сложном тесте на общий интеллект, где все предыдущие модели болтались у нуля. ARC-AGI-3 – это 135 мини-игр без правил и инструкций. Модель просто попадает в среду и должна сама понять, что здесь нужно делать, как победить, и перенести это понимание дальше. Результат Opus 4.8 – 1,4% на закрытом наборе. Предыдущая версия набирала 0,18%, GPT-5.5 – 0,43%. Люди решают 100%. Что меня зацепило: модель впервые начала читать среду абстрактно – как систему объектов, а не набор картинок. На одной из игр она вывела правило зеркального отражения уже к пятому кадру и прошла уровень за 24 действия. Предыдущая версия потратила 136 действий грубым перебором и правило так и не сформулировала. Разрыв с человеком всё ещё в два порядка – и это хорошо напоминает, что AGI не завтра. Но тип сдвига уже другой: не быстрее тот же подход, а качественно иное мышление. Вот это и есть тот момент, за которым я слежу.

