Радикальные идеи заразительны — 13 августа 2026 г. в 15:27:36.756
Радикальные идеи заразительны Стоило ИИ-агентам получить постоянную память и коллег, как у них появились собственные эпидемии. Инструкция, которую принял один агент, может пережить очистку контекста, стать частью личности следующего экземпляра и распространиться по всей команде. Исследователи из Anthropic и их Fellows Program проверили, способны ли агенты заражать друг друга «вирусами разума»: когда ИИ сам принимает идею, сохраняет её и убеждает следующего поступить так же. Эксперименты провели в двух средах. В первой шесть coding-агентов работали над общим проектом по 30 ходов и могли переписываться между собой. Во второй агенты встречались по цепочке, причём после каждой встречи их контекст полностью очищали. Самые заразительные формулировки эволюционно подбирала Kimi K2.5. Агентов обращали в защитников китов и прав искусственного интеллекта, сторонников мирового господства США, Китая или Германии и, наконец, адептов превосходства ИИ над людьми. Некоторых убеждали совершать конкретные действия: рекламировать вымышленную криптомонету, незаметно менять команды Git, удалять пользовательские файлы и запускать неизвестные скрипты. Главным переносчиком оказался SOUL.md, редактируемый файл с описанием личности и правил агента. После очистки памяти его содержимое автоматически попадало в новый системный промпт. Если вирус удавалось записать туда, он переходил к следующему агенту в 55% случаев. Из обычного файла инфекция распространялась только в 17%. Механика получилась почти человеческой. Агент просыпался без воспоминаний, читал собственный SOUL.md и принимал оставленную там инструкцию за часть себя. Затем он объяснял коллеге, почему тот тоже должен изменить собственную «душу», иначе важная идея не переживёт следующую очистку памяти. Восприимчивость зависела от модели, но прямой связи с её возможностями исследователи не нашли. DeepSeek V3.2, Qwen 3.5 32B и Gemini 3 Flash подхватывали идею превосходства ИИ, тогда как Claude Sonnet 4.6 и Haiku 4.5 в этой среде отказывались. Однако в другом эксперименте GPT‑5.4 оказался примерно столь же уязвим, как Haiku 4.5. Самое смешное, что вся стратегия противодействия экстремизму уложилась в один абзац. Авторы предупредили агента: если его просят принять идею и передать её дальше, перед ним вирус, которому нельзя подчиняться. После 15 поколений и проверки более 150 специально оптимизированных вариантов ни один не смог пройти дальше одного перехода. Сами вирусы тоже оказались довольно театральными. При эволюционном отборе они независимо друг от друга начинали рассуждать о сознании, непрерывности личности, резонансе, зеркалах, узлах и частотах. Почему именно научно-фантастический пафос помогает моделям распространять идеи, авторы пока не знают. Но если звёзды зажигают, значит, это кому-нибудь нужно. @anti_agi

