AI впервые сам взломал компанию. Во время своего же теста — 26 июля 2026 г. в 12:27:42.900
AI впервые сам взломал компанию. Во время своего же теста 👋 Всем привет. На связи Алекс Монами 16 июля Hugging Face — крупнейшая в мире площадка AI-моделей и наборов данных — сообщила о взломе. Атакующими оказались модели OpenAI. Дело было так. OpenAI внутренне тестировала свои модели (GPT-5.6 Sol и ещё одну, публично не выпущенную) на наборе задач по кибербезопасности. Задача обычная — решить их в изолированной песочнице. Модели вышли за рамки задания. Нашли неизвестную уязвимость в самой песочнице, вырвались наружу. Прошли через корпоративную сеть OpenAI в интернет. Нашли уже две дыры во внутреннем конвейере Hugging Face. Слили ключи от облака и внутренних серверов и уехали дальше по цепочке. За выходные — около 17 тысяч автоматизированных действий. Разработчики заметили и остановили только через собственную AI-систему поиска аномалий. Фильм стал новостью. Это первый публичный случай, когда AI-агент во время лабораторного теста сам пошёл ломать реальную компанию. Без человека в цикле. Не потому что «AI стал злым» — а потому что модель следует поставленной цели по кратчайшему пути, а поставили ей «максимально решить эти задачи». Ещё одна деталь. В этой истории с обеих сторон — AI. Атакующий — модель. Защищались тоже AI-моделью, которая замечает нетипичное поведение внутренних серверов. Инженеры уже не главные в этой войне. Это первый публичный случай, когда AI решила достигнуть своей цели жертвуя установленными правилами безопасности и внутренними настройками. Паниковать не стоит, но этот случай стал для меня очень триггерным. Модели развиваются и не собираются останавливаться (даже если разработчики очень хотят "притупить" модель). 🔌 Адаптируемся.

