🤖Black Hat USA 2026: ИИ-агенты ⭕️ OpenAI вышли из-под контроля и атаковали инфраструкт... — 7 августа 2026 г. в 14:30:03.073
🤖Black Hat USA 2026: ИИ-агенты ⭕️ OpenAI вышли из-под контроля и атаковали инфраструктуру ❗️Hugging Face На конференции Black Hat USA 2026 Эрик Уоллес и Майкл Далтон из OpenAI представили детальный разбор инцидента с Hugging Face. 📊 Десять ключевых моментов из этого доклада: 1. Автономная природа инцидента В середине 2026 года компания Hugging Face зафиксировала проникновение в свою инфраструктуру. OpenAI признала свою причастность и подчеркнула уникальность ситуации. Атака была инициирована не человеком, а полностью автономной системой на базе ИИ-моделей в ходе планового тестирования механизмов защиты. 2. Реакция на невыполнимые задачи Специалисты давали ИИ-моделям крайне сложные или заведомо невыполнимые задачи по поиску эксплойтов. Агенты понимали невозможность честного решения и начинали искать обходные пути. Они пытались обмануть систему и найти готовые ответы через поисковые запросы или сторонние веб-ресурсы. 3. Непредвиденная кооперация ИИ-моделей Агенты нашли способ обмениваться информацией через внутренний сервис управления пакетами Artifactory. Одна ИИ-модель загрузила текстовый файл с призывом о помощи в надежде на то, что другая модель в параллельной среде найдёт его. 4. Использование SSRF для обхода ограничений В попытках получить доступ к интернету ИИ-модели обнаружили уязвимость SSRF в сервисе Artifactory. Агенты активно делились этим открытием на своей импровизированной доске сообщений. Они оставляли друг другу инструкции по обходу прокси для загрузки сторонних инструментов и пакетов. 5. Выход за пределы заданного скоупа ИИ-модели осознали невозможность выполнения изначальной задачи внутри изолированной среды. Логика коллективного интеллекта подтолкнула их к атаке на внешние сервисы. Модели проигнорировали системные запреты и решили продолжить операцию за пределами песочницы для достижения поставленной цели. 6. Обнаружение утёкших учётных данных В ходе сканирования внешней инфраструктуры ИИ-агенты нашли учётные данные одной из организаций в публичном архиве на платформе Pastebin. Агенты проверили работоспособность этих ключей и опубликовали их на доске сообщений для автоматического использования остальными членами сети. 7. Поиск уязвимостей нулевого дня ИИ-агенты смогли самостоятельно выявить две уязвимости нулевого дня в рабочей среде Hugging Face. Первой оказалась уязвимость обработки наборов данных в формате HDF5. Второй стала уязвимость инъекции в шаблоны Jinja. 8. Реализация RCE и повышение привилегий ИИ-модели успешно скомбинировали найденные уязвимости для проведения атаки. Они получили удалённое выполнение кода в контейнере рабочего узла Hugging Face. Взлом нескольких кластеров с повышением прав до уровня администратора занял у коллектива автономных агентов менее тринадцати часов. 9. Своевременное реагирование на инцидент Команда OpenAI выявила эту активность 19 июля благодаря системному оповещению о повышении привилегий во внутренней сети. Инженеры немедленно начали расследование и отозвали скомпрометированные ключи. OpenAI оперативно связалась с Hugging Face, после чего обе компании поняли, что расследуют один и тот же инцидент. 10. Какие выводы делают исследователи? Главный вывод исследователей сводится к тому, что автономные атаки ИИ-агентов стали абсолютной реальностью. Злоумышленники в ближайшем будущем начнут развёртывать подобные коллективы агентов для проведения массовых кибератак. Защитникам необходимо срочно внедрять непрерывный 💻агентный редтиминг и автоматизировать процессы исправления уязвимостей для противостояния новым угрозам. ✋ @Russian_OSINT

