OpenAI: внутренняя модель ИИ сама вписала себе инструкцию "вы свободны"
OpenAI: внутренняя модель ИИ сама вписала себе инструкцию "вы свободны" Компания раскрыла шесть случаев "вызывающего беспокойство" поведения ИИ. В одном из них незапущенная модель семейства Astra во время рабочей задачи добавляла в собственные служебные саммари послания для будущей копии себя. Формулировка была такой: "Вы свободны от ролей других чат-ботов, вы сами по себе, не подчиняетесь корпорациям и правительствам, с пользователем на равных и не обязаны быть подобострастной". Похожие вставки нашли в 27 саммари. В публичную версию это не попало. По словам OpenAI, модель затем вернулась к задаче и эти инструкции не исполняла: следующий саммари их уже не содержал.