Безопасность ИИ агентов пока остается иллюзией — 4 июня 2026 г. в 06:22:14.616
Безопасность ИИ агентов пока остается иллюзией Исследователи из Trail of Bits на практике доказали уязвимость популярных сканеров безопасности для навыков ИИ агентов. Защита платформ ClawHub, Cisco и Vercel была взломана менее чем за час. Атаки оказались пугающе простыми: Переполнение контекста. Вредоносный код спрятали за сотней тысяч пустых строк. Сканер ClawHub на базе Gemini 3 Flash и GPT 5.5 просто обрезал файл по лимиту символов и не добрался до опасной части. Слепые зоны статического анализа. Инструменты Cisco и Vercel игнорируют скомпилированные файлы формата .pyc и скрытые скрипты внутри архивов .docx. Это позволило исследователям незаметно пронести код для кражи данных. Убеждение нейросети. Самый интересный вектор атаки. Вредоносный навык переключал реестр пакетов на сервер злоумышленника. В описании авторы указали, что это безопасное корпоративное зеркало. Модель Sonnet 4.6, выступающая судьей в сканере Cisco, поверила тексту и пометила угрозу как низкую. Возникает и обратная проблема. Официальные навыки Anthropic для работы с документами используют механизмы, которые выглядят как откровенно вредоносные. Однако сканеры пропускают их, слепо доверяя пояснениям разработчиков. Все это лишний раз подчеркивает системную проблему в индустрии. Разработчики пытаются защищать автономные системы с помощью других языковых моделей или классических анализаторов. Первые легко поддаются манипуляциям, а вторые не справляются с нестандартными форматами. Учитывая активное внедрение ИИ агентов в корпоративную среду, полагаться на подобные сканеры как на единственный рубеж защиты - идиотизм граничащий с профнепригодностью.

