🛡 DeepMind опубликовала архитектуру безопасности AI Control Roadmap — 19 июня 2026 г. в 12:30:01.532
🛡 DeepMind опубликовала архитектуру безопасности AI Control Roadmap DeepMind, подразделение Google, представила внутренний регламент контроля высокоразвитыми ИИ-агентами. Новая архитектура включает системный контроль, основанный на предположении потенциальной враждебности системы. Для анализа угроз был использован популярный фреймворк MITRE ATT&CK, создавший новую таксономию тактик и методов обхода защиты. Безопасность делится на уровни D1-D4 для обнаружения и R1-R3 для реагирования. На первых этапах анализируется поведение агента в контролируемых условиях, а на более высоких предлагаться более сложные меры контроля, включая аудит внутренних состояний модели и использование изолированных копий для проверки надежности. Также опубликован документ безопасном взаимодействии ИИ-агентов и общих рисках кибербезопасности.

