Tech Meridian ← К ЛЕНТЕ
PROМОЙ MERIDIAN EN

НОВОСТЬ · MODELS · #1485

Исследование Aleph Alpha: китайские модели повторяют партийную доктрину или отказываются отвечать на чувствительные вопросы

Aleph Alpha разработала бенчмарк из 967 специально подобранных табуированных тем и протестировала модели Alibaba (Qwen, в том числе Qwen 3.6), DeepSeek и Moonshot AI (Kimi). По собственной оценке компании, лишь 17–41% ответов были признаны сбалансированными; остальные повторяли государственную доктрину, уклонялись или отказывались отвечать, при этом прорежимная риторика иногда появлялась и в ответах на вопросы, не связанные с Китаем; у Nvidia Nemotron Cascade 2 тоже наблюдались партийные шаблоны в меньшинстве ответов.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. Aleph Alpha разработала бенчмарк из 967 специально подобранных табуированных тем и протестировала модели Alibaba (Qwen, в том числе Qwen 3.6), DeepSeek и Moonshot AI (Kimi).
  2. По собственной оценке компании, лишь 17–41% ответов были признаны сбалансированными; остальные повторяли государственную доктрину, уклонялись или отказывались отвечать, при этом прорежимная риторика иногда появлялась и в ответах на вопросы, не связанные с Китаем; у Nvidia Nemotron Cascade 2 тоже наблюдались партийные шаблоны в меньшинстве ответов.
  3. Эти выводы важны, поскольку политическая предвзятость или отказ отвечать в крупных языковых моделях влияет на доверие, рынок «суверенного ИИ» и потенциальное идеологическое влияние ИИ на миллиарды пользователей.

ПОЧЕМУ ЭТО ВАЖНО

Эти выводы важны, поскольку политическая предвзятость или отказ отвечать в крупных языковых моделях влияет на доверие, рынок «суверенного ИИ» и потенциальное идеологическое влияние ИИ на миллиарды пользователей.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1