Aleph Alpha评测中国模型敏感话题表现
热点事件观察中
Aleph Alpha评测中国模型敏感话题表现
1 篇报道1 个报道来源1 天前更新
先了解这件事
AI 综述
Aleph Alpha 发布一项敏感话题基准评测,用自家的 AI 评分系统给 Qwen、DeepSeek、Kimi 等中国模型在 967 个敏感话题上的回答打分,仅 17%–41% 被评为平衡,其余多是照搬官方立场或直接拒绝回答;其中 DeepSeek V4 Pro 拒答了三分之二的问题。话题包括天安门、台湾、新疆等。 Aleph Alpha 与 Cohere 一样自称面向政府的“主权 AI”供应商,报道指出其因此有商业动机把自身模型与中国竞品区分开;上述百分比由 Aleph Alpha 自己的评分系统给出。
AI 根据报道生成 · 2 小时前更新
最新进展10月4日 16:47
中国 AI 模型在敏感话题上照搬官方立场或拒绝回答报道时间线
沿着报道,了解事件的不同侧面。
10月4日
- The Decoder中国 AI 模型在敏感话题上照搬官方立场或拒绝回答
Aleph Alpha 测试 967 个敏感话题发现,Qwen、DeepSeek、Kimi 等中国模型仅 17%–41% 的回答被评为平衡,其余照搬官方立场或拒绝回答;DeepSeek V4 Pro 拒答三分之二的问题。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。