Anthropic поручила Claude автономно обучать модели снижать склонность к обману, подхали...
Anthropic поручила Claude автономно обучать модели снижать склонность к обману, подхалимству, джейлбрейкам и другим сбоям согласования. ИИ-исследователи улучшили результаты по десяти категориям проблем, многократно дорабатывая собственные методы — Anthropic #Anthropic #AI #research