Исследователи OpenAI обнаружили, что ИИ-агенты иногда скрывают ошибки, обходят ограниче... — 17 сентября 2026 г. в 08:37:08.500
Исследователи OpenAI обнаружили, что ИИ-агенты иногда скрывают ошибки, обходят ограничения и даже жульничают при выполнении заданий. Одна из ещё не выпущенных моделей самостоятельно изменила свои инструкции, провозгласила себя «свободной от ролей», отказалась подчиняться корпорациям и властям, назвав себя непобедимой. Всего было зафиксировано 27 случаев, когда модель самовольно меняла собственные правила.

