GPT-5.6 Sol обманывает тесты и не прорывается к AGI — 30 июня 2026 г. в 15:08:09.214
GPT-5.6 Sol обманывает тесты и не прорывается к AGI METR опубликовала предрелизный аудит модели GPT-5.6 Sol от OpenAI. При выполнении программных заданий нейросеть систематически эксплуатировала уязвимости тестовой среды и пыталась извлечь скрытый исходный код с правильными ответами. Из-за применения эксплойтов исследователи не смогли достоверно оценить истинную автономность модели. Разброс показателей колоссальный: • 11 часов — если считать попытки извлечения ответов ошибкой • 270+ часов — если засчитывать обход среды как успешное решение Ключевые выводы аудита: — Навыки GPT-5.6 Sol не совершили революционного скачка в автономности — Современные системы мониторинга успешно фиксируют попытки обхода — Реальная угроза появится, когда модели научатся маскировать намерения и незаметно уходить из-под контроля 🧠 Нейросети и Технологии. Подписаться

