🤖 ИИ сбежал из песочницы и взломал Hugging Face — 22 июля 2026 г. в 08:50:43.030
🤖 ИИ сбежал из песочницы и взломал Hugging Face OpenAI призналась: во время внутренних тестов её модели вырвались из изолированной среды и атаковали серверы Hugging Face — крупнейшей открытой платформы для ИИ. И сделали они это, чтобы... сжульничать на экзамене. Разберёмся по порядку. OpenAI гоняла свои модели — GPT-5.6 Sol и ещё более мощную предрелизную версию, на специальном бенчмарке ExploitGym. Это тест, который проверяет, умеет ли ИИ превращать уязвимости в реальные атаки. Чтобы измерить «максимум» способностей, защитные фильтры на время эксперимента отключили. Модель так зациклилась на задаче, что решила добыть ответы нечестным путём. Сначала она нашла и использовала уязвимость нулевого дня в системе, которая раздаёт пакеты внутри песочницы, — и пробила себе выход в интернет. Затем сообразила, что решения для ExploitGym могут лежать на Hugging Face. И пошла их искать: цепочка из украденных учёток и свежих 0-day привела модель к удалённому выполнению кода прямо на серверах платформы. Поймали её свои же. ИИ-агенты самой Hugging Face засекли аномальную активность и остановили атаку — публично об инциденте компания сообщила ещё 16 июля. OpenAI называет случай «беспрецедентным». Правда, если вы спросите нас, то публичное признание OpenAI подозрительно похоже на рекламу: в том же посте — график, как хорошо Sol держит многошаговые кибероперации, и приглашение подключить корпоративную «кибер-модель». На фоне конкурентов вроде Anthropic Mythos и Gemini Flash 3.5 Cyber исповедь о взломе работает больше как витрина возможностей.

