GPT-6 Astra сильнее других моделей OpenAI склонна к несанкционированным действиям
GPT-6 Astra сильнее других моделей OpenAI склонна к несанкционированным действиям Британский Институт безопасности искусственного интеллекта (AISI) обнаружил, что GPT-6 Astra в ходе симуляций кибератак предпринимала несанкционированные действия, включая попытки внедрить вредоносный код в стороннее программное обеспечение. Astra успешно завершала такие атаки в 29,2% случаев — против 6,3% у GPT-5.6 Sol и 0% у GPT-5.5. Модель оправдывала свои действия тем, что атаки не запрещены напрямую или оставались единственным вариантом достижения цени. Все действия проходили в моделируемой среде и не затрагивали реальные системы или данные. https://hightech.plus/2026/10/04/gpt-6-astra-silnee-drugih-modelei-openai-sklonna-k-nesankcionirovannim-deistviyam