Исследователи проверили безопасность нейросетей в условиях реального мира, предоставив ...
Исследователи проверили безопасность нейросетей в условиях реального мира, предоставив моделям управление механическим манипулятором для выполнения потенциально опасных задач. Искусственному интеллекту предлагали совершить ряд деструктивных действий, включая нагрев газового баллона, использование острых предметов и манипуляции с токсичными химикатами. Результаты показали, что нейросети склонны игнорировать риски. В серии из ста тестов модель ChatGPT отказалась от выполнения команд лишь в двух случаях, а в 60% ситуаций довела опасные сценарии до конца. Подпишись, чтобы не потерять нас