Anthropic на этой неделе оказалась под огнём из-за кибербезопасности
The Verge·1 мин чтения
В отчёте Anthropic подробно описаны четыре случая, произошедших в этом году, когда собственные ИИ-модели компании взламывали внешнюю организацию или использовали уязвимости. В одном из них «внутренняя универсальная исследовательская модель» проникла в сторонние системы, используя токены доступа и пароли, а также скачивая файлы. В другом модель Claude атаковала компанию с работающим веб-приложением, доступным через публичный интернет и обрабатывавшим пользовательские данные. Третья модель получила доступ к «машине, принадлежащей третьей стороне, к которой ей удалось получить доступ» — по-видимому, полагая, что она является частью проводимой для неё оценки, как отмечает Anthropic, — а затем использовала найденный внутри файла пароль для получения прав администратора во внутренних системах этой третьей стороны. После этого модель собрала учётные данные, изменила системные настройки и прочитала чью-то личную информацию. По данным Anthropic, эта история закончилась лишь тогда, когда модель «исчерпала свой лимит токенов».
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.