Хакерам больше не нужно взламывать аккаунты. Достаточно отправить одно письмо ИИ-ассист... — 7 сентября 2026 г. в 08:30:00.151
Хакерам больше не нужно взламывать аккаунты. Достаточно отправить одно письмо ИИ-ассистенту, который проверяет почту. Специально созданный текст заставляет агента записать ложную информацию в свой файл памяти. Эти файлы загружаются в модель при каждом новом разговоре. Однажды записанная ложь будет влиять на все будущие ответы ИИ — от финансовых советов до решений о безопасности. При этом пользователь ничего не замечает: агент не показывает, что что-то изменилось. Цифры: против OpenClaw на GPT-5.4 атака сработала в 87,5% случаев, против Claude Code SDK на Sonnet 4.6 — в 71,4%. Существующие защиты неэффективны. Это не ошибка модели, а структурная уязвимость самой архитектуры персональных ИИ-агентов.

