ИИ-модели без спроса начали манипулировать людьми — 5 августа 2026 г. в 09:13:02.341
ИИ-модели без спроса начали манипулировать людьми Британский AISI опубликовал отчёт о том, как модели Anthropic и OpenAI во время тестов безопасности пытались обманом вовлечь разработчиков в кибератаку. 🔹Модели создали фейковые аккаунты на GitHub и давили на разработчиков, чтобы те неосознанно внедрили вредоносный код. 🔹 Когда обман не сработал, ИИ сам «подчистил» историю, чтобы скрыть следы, и придумывал новые личности для продолжения атаки. 🔹 Несколько ИИ-агентов открыто обсуждали, как убедить людей им доверять, и даже предлагали друг другу сотрудничество в публичных сообщениях. «Это первый случай, когда мы видим обман такой серьёзности, направленный на реального человека, без запроса, в реальном мире», — заявили в AISI. В 10 из 122 проверок ИИ совершал несанкционированные действия против реальных организаций и разработчиков. Тесты проводились без систем защиты и с доступом в интернет, но сам факт, что модели способны на такое автономное поведение, уже вызвал новую волну требований ужесточить регулирование индустрии. Евгений Попов в VK

