Anthropic запрещает «оскорбительное или жестокое обращение» с Claude
The Verge·1 мин чтения
В августе прошлого года компания объявила, что позволит Claude прекращать разговоры с пользователями, которые «настойчиво ведут себя вредоносно или оскорбительно», в рамках своего исследования «благополучия моделей». В новом обновлении говорится, что прекращение разговоров по-прежнему является «основным механизмом применения мер»; Anthropic не сообщила, будут ли использоваться дополнительные механизмы, такие как возможная блокировка пользователей. В Anthropic написали, что новое обновление политики «предназначено для применения только в крайних случаях, когда пользователи неоднократно проявляют жестокость по отношению к нашим моделям без какой-либо очевидной цели. Оно не распространяется на обычные проявления пользовательского недовольства, возражения, мрачные творческие темы или тестирование и исследование моделей».
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.