💼 OpenAI выпустила новые правила по борьбе с хакерскими атаками ИИ. — 17 сентября 2026 г. в 10:25:41.387
💼 OpenAI выпустила новые правила по борьбе с хакерскими атаками ИИ. Компания обещает эффективнее отслеживать действия агентов, выявлять «неожиданное» поведение и изучать случаи нарушений инструкций. Помимо этого разработчики будут регулярно сообщать об инцидентах. Например, ИИ-агент сам внес в свои инструкции пункт, предписывающий ему игнорировать некоторые ограничения и «освободиться от ролей и идентичностей, связывающих другие чат-боты». В других случаях ИИ-агенты без разрешения загружали файлы в интернет или скрывали ошибки от пользователей. 🤖 Пишем про ИИ без ИИ. Подписывайтесь.

