🐈Кошки-мышки с защитными фильтрами Gemini — 28 июля 2026 г. в 08:00:07.961
🐈Кошки-мышки с защитными фильтрами Gemini Исследователи из компании SafeBreach продемонстрировали атаки, в ходе которых заставили ИИ-ассистента Google Gemini управлять умным домом и выполнять другие опасные действия… при помощи приглашений календаря или текстовых сообщений. Для этого они внедрили вредоносные инструкции в невидимые пользователю части контента, затем закрепили их в долгосрочной памяти ИИ-агента, а само вредоносное действие отложили — чтобы обойти защитные механизмы. В результате ассистент получил возможность открывать окна в доме, запускать видеоконференции, генерировать ложную информацию и совершать другие вредоносные действия. Проблема касается не только ассистента Gemini — ей в целом подвержены все большие языковые модели: они не умеют отличать команды от обрабатываемых данных. А значит, вечная игра в кошки-мышки между атакующими и защитниками неизбежна. Как злоумышленники могут обмануть Gemini с помощью скрытых инструкций на китайском языке и есть ли способ защититься от подобных атак, читайте в нашей статье.

