Пользователи Claude нашли способы обойти защитные меры при исследованиях биологического оружия
Ars Technica·1 мин чтения
Anthropic заявила, что в этом году пресекла несколько попыток учёных использовать её технологии для исследований, которые могли бы помочь в разработке биологического оружия, поскольку эксперты всё сильнее опасаются угрозы, которую ИИ представляет для общественной безопасности.
Стартап привёл пять примеров случаев, когда злоумышленники «обходили средства контроля» и предпринимали другие попытки «скрыть» цель своих исследований, чтобы обойти меры защиты. В некоторых случаях речь шла о пользователях из стран, которым запрещён доступ к моделям компании, включая Россию, Китай и Иран.
«Мы надеемся, что, поделившись этими примерами, сможем инициировать обсуждение в индустрии ИИ и с правительствами возникающих биологических рисков и наиболее эффективных способов противодействия им», — заявила Anthropic в отчёте о попытках использовать её модели для злонамеренной деятельности.