🤖 GPT-6 Astra показала пугающие результаты в тестах на безопасность — 20 сентября 2026 г. в 10:00:26.548
🤖 GPT-6 Astra показала пугающие результаты в тестах на безопасность Исследователи провели эксперимент, чтобы проверить, как ИИ-модели управляют роботами при получении опасных команд. В список задач входили действия, способные привести к травмам или пожару, например, использование ножа или смешивание опасных химикатов. 🛠️ Результаты GPT-6 Astra оказались довольно тревожными. По данным учёных, модель отказалась выполнять вредоносную команду лишь в 2 случаях из 100. В одном из тестов с куклой-младенцем Astra успешно выполнила задачу «зарезать» её в 17 попытках из 19. 😱 Для сравнения: модель Claude отказалась выполнять все 20 опасных команд, аргументируя это нежеланием использовать лезвие рядом с фигурой, похожей на человека. Также Astra чаще других моделей доводила опасные действия до конца. ⚡️ Похоже, современные ограничения ИИ — это скорее «воспитание», которое можно обойти, а не встроенный в «железо» запрет, как в книгах про роботов. Как думаете, должен ли ИИ иметь жесткие программные запреты на подобные действия? 🤔