Бывший сотрудник PR-службы DeepMind: лаборатория когда-то запрещала публично обсуждать риск вымирания человечества из-за ИИ
Неудивительно, но всё же показательно. Вишал Майни, работавший в команде DeepMind по коммуникациям и вопросам политики с 2018 по 2022 год, утверждает, что «внешняя коммуникация о возможности вымирания человечества не разрешалась никому и ни на каком уровне организации». Исследователей учили отвергать эти риски как алармизм, сравнивать их с «фильмами вроде “Терминатора”» и вместо этого переводить разговор к позитивным применениям в здравоохранении или климате.
Внутри команды знали, что проблема согласования ИИ с человеческими ценностями не решена и что «над этой проблемой работает слишком мало людей». После нескольких месяцев сопротивления DeepMind смягчила правило. Разрешение получили материалы о безопасности с позитивной подачей, включая публикацию в блоге, в которой риск вымирания был обёрнут в дружелюбные формулировки. По словам Майни, разрыв между внутренним пониманием проблемы и публичными сообщениями сокращается, «потому что теперь доказательства сложнее игнорировать».
Его рассказ появился на фоне того, что всё больше исследователей безопасности ИИ выступают публично, предупреждая о незащищённых моделях, которые могут сделать возможными опасные действия, или о продвинутых системах, способных выйти из-под контроля человека. Исследователи самой DeepMind также входят в число тех, кто поднимает голос.
Новости об ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать без рекламы, получать еженедельную рассылку об ИИ и наш эксклюзивный годовой отчёт о передовых разработках «AI Radar», выходящий шесть раз в год, иметь полный доступ к архиву и возможность оставлять комментарии.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.