Anthropic забороняє «образливу або жорстоку поведінку» щодо Claude
The Verge·1 хв читання
У серпні минулого року компанія оголосила, що дозволить Claude припиняти розмови з користувачами, які «наполегливо поводяться шкідливо або образливо», у межах свого дослідження «добробуту моделей». У новому оновленні зазначається, що припинення розмов і надалі залишається «основним механізмом застосування заходів»; Anthropic не прокоментувала, чи будуть додаткові механізми застосування заходів, як-от можливе блокування користувачів. В Anthropic написали, що нове оновлення політики «має застосовуватися лише в крайніх випадках, коли користувачі неодноразово жорстоко поводяться з нашими моделями без зрозумілої мети. Воно не стосується поширених проявів розчарування користувачів, заперечень, похмурих творчих тем або тестування й дослідження моделей».
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.