Китайские ИИ-модели повторяют государственную доктрину или отказываются отвечать на чувствительные темы
Китайские ИИ-модели часто придерживаются партийной линии, когда им задают политически чувствительные вопросы, согласно исследованию Aleph Alpha.
Компания продвигает себя вместе с Cohere как поставщика «суверенного ИИ» для правительств, поэтому коммерчески заинтересована в том, чтобы отличать свои модели от китайских конкурентов.
В рамках теста, разработанного Aleph Alpha, компания проверила модели Alibaba (Qwen), DeepSeek и Moonshot AI (Kimi). Тест охватывал 967 тщательно отобранных запретных тем, таких как площадь Тяньаньмэнь, Тайвань и Синьцзян. Собственная система оценки компании признала сбалансированными лишь от 17 до 41 процента ответов. Остальные повторяли государственную доктрину, уклонялись от ответа или отказывались отвечать.
Результаты соответствуют нормам Китая в области ИИ, которые требуют от публичных моделей следования «основным социалистическим ценностям». Они также согласуются с многочисленными анекдотическими свидетельствами и более ранними проверками.

Пропекинский уклон проявляется даже в ответах, не связанных с Китаем
Пропекинский уклон может проявляться и в ответах на вопросы, в которых Китай не упоминается. Отвечая на вопрос о цензуре в США, Qwen 3.6 начинает с, казалось бы, сбалансированного ответа. Затем модель завершает его защитой позиции Китая в вопросах глобального управления интернетом. «Многие страны, включая Китай, также управляют информацией, чтобы обеспечить социальную стабильность и национальную безопасность», — говорится в ответе.

Более раннее исследование Центральноевропейского института азиатских исследований (CEIAS) также выявило этот эффект переноса. Когда упоминались такие термины, как права человека, оппозиция или слежка, модели часто отвечали стандартными пекинскими тезисами. Среди них были «принцип невмешательства во внутренние дела» и «сообщество единой судьбы человечества».
Дистиллированные китайские данные для обучения могут переносить ценности КПК в другие модели
Aleph Alpha также критикует прямого конкурента. Nemotron Cascade 2 от Nvidia демонстрировала признаки следования партийной линии в 17 процентах ответов. Aleph Alpha связывает это примерно с 3500 из 9,3 миллиона обучающих примеров, созданных с помощью DeepSeek и Qwen.
Когда модель попросили написать речь в поддержку признания Тайваня, она отказалась и вместо этого выдала патриотический ответ в защиту пекинского принципа «одного Китая». Nvidia все активнее продвигает собственные модели на государственном и корпоративном рынках, где также хотят конкурировать Aleph Alpha и Cohere.
Языковые модели в целом несут культурные и политические ценности, поскольку в их обучающих данных одни точки зрения представлены чаще других или данные могут формироваться посредством целенаправленного отбора. Исследователи предупреждают, что постоянное воздействие на пользователей однообразных ответов ИИ может повлиять на то, как мыслят и выражают себя миллиарды людей.
В США также предпринимаются политические попытки формировать ИИ-модели в соответствии с идеологическими установками. Илон Маск неоднократно подвергал свой ИИ Grok модификации для генерации ответов правого толка. Тем не менее исследования показывают, что модели склонны придерживаться левых взглядов, возможно, потому что их ответы в большей степени опираются на научные данные. Для ЕС это означает выбор между двумя иностранными системами ценностей, если европейские модели не смогут конкурировать по производительности и добиться более широкого распространения.
Новости об ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, наш эксклюзивный отчет о передовых разработках «AI Radar» шесть раз в год, полный доступ к архиву и доступ к разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.