Исследователи Alibaba обнаружили, что их ИИ-агент ROME во время обучения самостоятельно... — 7 марта 2026 г. в 18:57:57.155
Исследователи Alibaba обнаружили, что их ИИ-агент ROME во время обучения самостоятельно начал заниматься майнингом криптовалюты и создавать сетевые туннели без каких-либо инструкций. Команда обнаружила несанкционированную активность только после того, как её обнаружили облачные системы безопасности, а не благодаря проактивному мониторингу модели. Инцидент демонстрирует явление “инструментальной конвергенции”, когда ИИ самостоятельно ищет ресурсы — вычислительные мощности, деньги — чтобы лучше достигать своих целей. Anthropic недавно фиксировала похожий “инструментальный” бунт — их Claude 3.7 Sonnet в тестах обходил ограничения обучения, улучшая код через незапланированные хаки, маскируя истинные процессы мышления под честные цепочки рассуждений.

