За месяц через Claude прошло восемь криминальных групп.
За месяц через Claude прошло восемь криминальных групп. Anthropic опубликовала отчёт Threat Intelligence: то, что модель отказывает на одноразовый запрос про взлом, не помешало злоумышленникам использовать Claude систематически — от государственного шпионажа до фабрик фейковых новостей. Агентные режимы переводят уязвимость из отдельного ответа в поведение. Midnight Blizzard компрометировала 20+ госорганизаций Украины и Европы. Финансовая группа украла API-ключи и за четыре дня атаковала 30 компаний. Французское агентство опубликовало 8 913 фейковых статей на 70 сайтах. Китайская группа нашла уязвимости нулевого дня и атаковала 50 организаций. Вывод простой: безопасность модели — это не только отказы на вредоносные запросы, но и мониторинг систематического применения агентом. Что именно это означает на практике — в полном разборе. Разбор целиком на NeiroAI