The Decoder· 16:47AI 评分4444中国 AI 模型在敏感话题上照搬官方立场或拒绝回答Aleph Alpha 测试 967 个敏感话题发现,Qwen、DeepSeek、Kimi 等中国模型仅 17%–41% 的回答被评为平衡,其余照搬官方立场或拒绝回答;DeepSeek V4 Pro 拒答三分之二的问题。论文#论文/研究#评测/基准#安全/对齐