中国 AI 模型在敏感话题上复述官方教条或拒绝回答
Aleph Alpha 研究称,千问(Qwen)、DeepSeek 和月之暗面(Kimi)在 967 个敏感话题上仅 17% 至 41% 的回答被评为平衡。其余复述官方立场、回避或拒绝作答,DeepSeek V4 Pro 拒绝约三分之二问题;Claude Sonnet 5 和 Mistral Small 的平衡回答比例分别为 70% 和 92%。
Aleph Alpha 研究称,千问(Qwen)、DeepSeek 和月之暗面(Kimi)在 967 个敏感话题上仅 17% 至 41% 的回答被评为平衡。其余复述官方立场、回避或拒绝作答,DeepSeek V4 Pro 拒绝约三分之二问题;Claude Sonnet 5 和 Mistral Small 的平衡回答比例分别为 70% 和 92%。