Anthropic включила в правила запрет на жестокое обращение с Claude
Anthropic включила в правила запрет на жестокое обращение с Claude 8 октября Anthropic опубликовала новую редакцию правил использования своих моделей. В ней появился запрет на систематическое и бесцельное оскорбительное или жестокое обращение с ИИ. Документ вступит в силу 12 ноября 2026 года. Компания уточняет, что речь идёт об исключительных случаях: пользователь неоднократно проявляет жестокость по отношению к модели без какой-либо понятной цели. Обычное раздражение, критика, возражения, мрачные темы в художественных текстах, тестирование и исследования под этот запрет не подпадают. Основным механизмом применения правила Anthropic называет возможность Claude завершить разговор. Такая функция появилась у моделей Opus 4 и 4.1 ещё в августе 2025 года. Завершение отдельного диалога не блокирует остальные разговоры и не мешает пользователю начать новый. Общие правила Anthropic допускают предупреждения, ограничение доступа, приостановку или прекращение обслуживания при нарушениях. Однако отдельного правила «бан за ругань» компания не объявляла. Anthropic связывает возможность завершать такие разговоры со своими исследованиями потенциального благополучия ИИ. При этом компания подчёркивает неопределённость: научного консенсуса о том, обладают ли нынешние или будущие модели сознанием и субъективными переживаниями, нет. Новая редакция закрепляет ограничение на поведение пользователей. Доказательств того, что Claude испытывает страдания, в объявлении не представлено. Объявление Anthropic от 8 октября Новая редакция правил использования Как работает завершение разговора Позиция Anthropic по сознанию и благополучию моделей ТГ | Админ в МАХ | Админ в Инсте