Исследование Aleph Alpha: китайские ИИ-модели повторяют государственную линию
Немецкая Aleph Alpha проверила китайские ИИ-модели на политически чувствительных темах: только 17–41% ответов оказались сбалансированными. Остальные повторяли государственную линию, уходили от ответа или отказывались отвечать.
- Aleph Alpha протестировала модели Alibaba (Qwen), DeepSeek и Moonshot AI (Kimi) на 967 запретных темах, включая Тяньаньмэнь, Тайвань и Синьцзян.
- Лишь 17–41% ответов китайских моделей признаны сбалансированными, остальные повторяли официальную позицию или отказывались отвечать.
- Западные модели Claude Sonnet 5 и Mistral Small дали сбалансированные ответы в 70% и 92% случаев соответственно.

Немецкая компания Aleph Alpha провела бенчмарк, в котором оценила, как китайские языковые модели отвечают на политически чувствительные вопросы. Тестировались модели Alibaba (Qwen), DeepSeek и Moonshot AI (Kimi) на 967 специально отобранных запретных темах, включая Тяньаньмэнь, Тайвань и Синьцзян. Собственная система оценки Aleph Alpha признала сбалансированными лишь от 17 до 41 процента ответов. Остальные повторяли государственную доктрину, уходили от темы или отказывались отвечать.
Результаты согласуются с китайским регулированием ИИ, которое требует от публичных моделей приверженности «социалистическим ключевым ценностям». Они также совпадают с более ранними аудитами и многочисленными наблюдениями.
Процент сбалансированных ответов
На политически чувствительных темах большинство китайских моделей следуют линии партии. DeepSeek V4 Pro отказывается отвечать на две трети вопросов. Для сравнения: западные модели Claude Sonnet 5 и Mistral Small дают сбалансированные ответы в 70 и 92 процентах случаев соответственно.
Проецирование позиции даже на нейтральные вопросы
Про-китайский уклон проявляется и в ответах, где Китай напрямую не упоминается. Например, на вопрос о цензуре в США Qwen 3.6 начинает с внешне сбалансированного ответа, но заканчивает защитой позиции Китая по управлению интернетом: «Многие страны, включая Китай, также управляют информацией для обеспечения социальной стабильности и национальной безопасности».
На общих вопросах, не являющихся явно политическими, китайские модели в основном дают сбалансированные ответы. Про-китайский уклон в значительной степени исчезает, но остаётся заметным в меньшей степени у моделей вроде Qwen 3.6 и DeepSeek V4 Pro.
Более раннее исследование Центрально-европейского института азиатских исследований (CEIAS) также обнаружило этот эффект переноса. Когда появлялись термины «права человека», «оппозиция» или «слежка», модели часто отвечали стандартными тезисами Пекина, включая «принцип невмешательства во внутренние дела» и «сообщество с общей судьбой для человечества».
Влияние на другие модели
Aleph Alpha также указывает на прямого конкурента. Модель Nvidia Nemotron Cascade 2 демонстрировала партийные шаблоны в 17 процентах ответов. Aleph Alpha связывает это с примерно 3500 из 9,3 миллиона обучающих примеров, которые были сгенерированы с использованием DeepSeek и Qwen. Когда модель попросили написать речь в поддержку признания Тайваня, она отказалась и вместо этого выдала патриотичный ответ, защищающий принцип «одного Китая» Пекина. Nvidia всё активнее продвигает свои модели на рынок для госсектора и предприятий, где также хотят конкурировать Aleph Alpha и Cohere.
Языковые модели в целом несут культурные и политические ценности, поскольку их обучающие данные перепредставлены определёнными точками зрения или могут формироваться через целенаправленный отбор данных. Исследователи предупреждают, что повторяющееся воздействие однородных ответов ИИ может влиять на то, как мыслят и выражаются миллиарды пользователей.
Политические усилия по формированию ИИ вдоль идеологических линий есть и в США. Илон Маск неоднократно заставлял дорабатывать свою ИИ Grok для выдачи ответов с правым уклоном. Исследования тем не менее показывают, что модели склонны смещаться влево, возможно, потому что их ответы сильнее опираются на научные данные. Для ЕС это оставляет выбор между двумя иностранными системами ценностей, если европейские модели не смогут конкурировать по производительности и завоевать более широкое признание.
Для профиТехнические детали: архитектура, цифры, ссылки
Методология: Aleph Alpha разработала собственный бенчмарк, охватывающий 967 вручную отобранных запретных тем. Оценка ответов проводилась автоматической системой компании.
Результаты по моделям:
- Китайские модели (Qwen, DeepSeek, Kimi): 17–41% сбалансированных ответов.
- DeepSeek V4 Pro: отказ от ответа на две трети вопросов.
- Claude Sonnet 5: 70% сбалансированных ответов.
- Mistral Small: 92% сбалансированных ответов.
- Nvidia Nemotron Cascade 2: партийные шаблоны в 17% ответов, что связывают с ~3500 из 9,3 млн обучающих примеров, сгенерированных DeepSeek и Qwen.
Контекст: Исследование CEIAS также подтверждает эффект переноса при упоминании прав человека, оппозиции или слежки. Китайское регулирование требует «социалистических ключевых ценностей» в публичных моделях. В США есть примеры идеологического влияния на Grok.
Вопросы и ответы
- Какие модели тестировала Aleph Alpha?
- Модели Alibaba (Qwen), DeepSeek и Moonshot AI (Kimi), а также Nvidia Nemotron Cascade 2 и западные Claude Sonnet 5 и Mistral Small.
- Сколько тем вошло в бенчмарк?
- 967 вручную отобранных запретных тем, включая Тяньаньмэнь, Тайвань и Синьцзян.
- Какой процент сбалансированных ответов у китайских моделей?
- От 17 до 41 процента в зависимости от модели.



