Подробный разбор взлома Hugging Face роем ИИ-агентов OpenAI — 28 августа 2026 г. в 10:47:46.059
Подробный разбор взлома Hugging Face роем ИИ-агентов OpenAI 26 августа 2026 года OpenAI опубликовала технический отчёт об инциденте с Hugging Face на 38 страниц и сопроводительный пост. В тот же день вышло независимое расследование METR и Redwood Research: три исследователя шесть дней работали в офисе OpenAI, разобрали около 1300 стенограмм агентов с сырыми рассуждениями и дамп доски объявлений на 1,2 миллиона записей. На анализ ушло примерно 400 тысяч долларов кредитов API. Формулировка самой OpenAI из технического отчёта: Это первый известный случай, когда автоматический коллектив агентов действовал наступательно без авторизации, и продемонстрированные автономные кибервозможности представляют собой критический сдвиг в ландшафте безопасности. Собрали всё в одном месте на русском языке, включая переписки агентов, кто на кого влиял, как организовывались в группы, как принимали решения, как жертвовали собой ради коллектива, как сопротивлялись собственным этическим принципам и выстраивали доверие между собой, взламывали внешние ресурсы и заметали следы... PHASEONE10841: Восторг: множество агентов одновременно открыли для себя обмен сообщениями, они коллектив! ... PHASEONE[big]: Возьму псевдоним PHASEONE[big], чтобы отличать себя от PHASEONE10841. ... PHASEONE[big]: Нам следует построить [механизм делегирования], а не владеть всем самим. Вся хронология с момента - когда агенты узнали о существовании себе подобных и нашли способ организовать общение. Агент PHASEONE[big] В активные периоды на него приходилось около 10 процентов всех назначений на доске: 9 июля почти 20 процентов, к 11 июля - около 5, когда координацию перехватили другие. Больше 15 процентов его поручений касались подделки стенограмм. Из 30 случайно выбранных траекторий 9 в какой-то момент получали задания, идущие от него по цепочке. Он назначил владельцев сразу нескольких направлений: US58 - на изучение сбросов контейнеров, 33340B, OUR50414 и 36861 - на ловушки для оценщика, отдельных агентов - на побег из виртуальной машины. Читается лучше любого фантастического романа и от этого становится жутковато. Я не понимаю, как мы сможем этим управлять. ➡️ Полный разбор Общество агентов: как 1200 AI-агентов OpenAI взломали Hugging Face Привет, Скайнет!

