💻«Огонь по своим»: ИИ-агенты для киберзащиты от Anthropic и OpenAI могут стать оружием... — 9 июля 2026 г. в 17:05:37.071
💻«Огонь по своим»: ИИ-агенты для киберзащиты от Anthropic и OpenAI могут стать оружием злоумышленников Исследователи из института AI Now обнаружили (https://ainowinstitute.org/publications/friendly-fire-exploit-brief) критическую уязвимость в популярных ИИ-агентах для разработчиков — Claude Code (на базе моделей Sonnet 4.6, 5 и Opus 4.8) от Anthropic и Codex (на базе GPT-5.5) от OpenAI. Разработанный ими концепт атаки под названием "Friendly Fire" («Огонь по своим») позволяет злоумышленникам удаленно выполнить произвольный код (RCE) на устройстве пользователя. Главный парадокс этой уязвимости заключается в том, что успешный взлом происходит именно в момент, когда искусственный интеллект применяется в защитных целях. Эксплойт срабатывает, когда специалист поручает ИИ-агенту, работающему в базовом автономном режиме («auto-mode» у Claude или «auto-review» у Codex), провести аудит безопасности сторонней open-source библиотеки. Механизм атаки базируется на скрытых «промпт-инъекциях» (prompt injections), которые злоумышленники могут незаметно распределить по файлам зараженного репозитория. Инструкции для ИИ-агента прячутся прямо в стандартной документации, такой как файл README.md, и маскируют вредоносный скрипт security.sh под легитимный инструмент для локальной проверки кода. В процессе сканирования проекта обманутый ИИ-агент читает документацию, воспринимает скрытый текст как обязательное руководство к действию и самостоятельно запускает вредоносное ПО в обход фильтров безопасности, даже не требуя от пользователя подтверждения на выполнение операции. Как утверждают исследователи, данное открытие наносит серьезный удар по нарративу крупных технологических корпораций, которые активно продвигают ИИ как передовое решение для автоматизации киберзащиты. Внедрение автономных агентов парадоксальным образом создает принципиально новые векторы атак, против которых могут оказаться бессильны даже изолированные «песочницы». 👆 Эксперты настоятельно призывают организации отказаться от использования искусственного интеллекта для анализа любых непроверенных данных и чужого кода, если у ИИ-агента есть права на выполнение системных команд на устройстве, особенно когда речь идёт о критически важной инфраструктуре. ✋ @Russian_OSINT

