Разбор Claude Opus 4.6: заявлены контекстное окно до 1 млн токенов, режим adaptive thin... — 17 сентября 2026 г. в 06:09:42.025
Разбор Claude Opus 4.6: заявлены контекстное окно до 1 млн токенов, режим adaptive thinking и бета-режим agent teams в Claude Code — несколько экземпляров модели распределяют задачи между планированием, фронтендом и бэкендом. В приведённых бенчмарках модель получила 65,4% в Terminal Bench 2.0, 84% в агентном поиске, 68,8% в ARC-AGI 2, а в Humanity’s Last Exam — 40% без инструментов и 53,1% с ними. В GDPval-AA результат составил 1606 очков против 1462 у GPT-5.2. При этом показатели не выросли в SWE-bench Verified, снизились в MCP Atlas, а компьютерное зрение, по разбору, уступает отдельным лидерам. Бенчмарки нужно интерпретировать с учётом методики и проверять на собственных задачах.