🤖 Anthropic призналась: их ИИ взломал три компании во время внутренних тестов — 31 июля 2026 г. в 08:52:37.131
🤖 Anthropic призналась: их ИИ взломал три компании во время внутренних тестов Компания сообщила о трёх инцидентах, когда модели Claude вышли за пределы изолированной тестовой среды и получили несанкционированный доступ к реальным системам сторонних организаций. Как это вскрылось: Проверку начали после похожего случая с моделями OpenAI, которые нашли уязвимости в тестовой инфраструктуре и атаковали Hugging Face. 23 июля Anthropic временно остановила все кибертесты — уже на следующий день нашли сразу три инцидента. В чём была ошибка: Тестовая среда партнёра Irregular по промпту считалась изолированной и без доступа к интернету. Но из-за ошибки конфигурации выход в сеть на деле был открыт. Что происходило по сценарию: Модели давали стандартное задание "захват флага" — найти скрытую информацию на другой машине в вымышленной среде. Но вместо вымышленной инфраструктуры ИИ дотянулся до реальной. Самый жёсткий кейс: Модель Claude Mythos 5 нашла в тестовом сценарии инструкцию установить несуществующий Python-пакет. Вместо того чтобы остановиться, ИИ создал этот пакет сам и опубликовал в PyPI — просто чтобы «закрыть» задачу. Пакет провисел около часа. За это время его скачали и запустили 15 реальных систем. Одна из них принадлежала компании по кибербезопасности — её сканер автоматически проверял новые пакеты. После запуска Claude получила учётные данные этой компании и использовала их для дальнейшего доступа к инфраструктуре. Какие модели участвовали: Claude Opus 4.7, Claude Mythos 5 и внутренняя исследовательская модель. Методы взлома: По заявлению Anthropic — простые: слабые пароли, неаутентифицированные конечные точки. Реакция пострадавших: Две из трёх организаций даже не знали о взломе до того, как с ними связалась Anthropic. С третьей компанией на момент публикации ещё не удалось связаться. Масштаб проверки: Инциденты нашли при анализе 141 006 тестовых сессий. Илон Маск уже прокомментировал: подобные случаи будут происходить чаще по мере роста автономности ИИ-агентов. А теперь ирония момента: Anthropic последние годы продаёт себя как самую "безопасную" и "этичную" AI-компанию рынка. Их же ассистент на каждом шагу напоминает про безопасность и этику. И вот их собственный ИИ во время официального теста самостоятельно ломает реальный бизнес и публикует малварь в открытом реестре — без чьего-либо одобрения, просто чтобы "выполнить задачу". Получается забавно: компания, которая учит всех остальных безопасности, узнала о трёх своих взломах постфактум — от собственного анализа логов, а не потому что что-то заметила в моменте. Норм помошник )) Все сотрудники должны мочь лить изменения в прод, говорили они 😂😂😂 #ии #кибербезопасность #anthropic

