跳到正文
热点事件观察中

Aleph Alpha评测中国模型敏感话题表现

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

Aleph Alpha 发布一项敏感话题基准评测,用自家的 AI 评分系统给 Qwen、DeepSeek、Kimi 等中国模型在 967 个敏感话题上的回答打分,仅 17%–41% 被评为平衡,其余多是照搬官方立场或直接拒绝回答;其中 DeepSeek V4 Pro 拒答了三分之二的问题。话题包括天安门、台湾、新疆等。 Aleph Alpha 与 Cohere 一样自称面向政府的“主权 AI”供应商,报道指出其因此有商业动机把自身模型与中国竞品区分开;上述百分比由 Aleph Alpha 自己的评分系统给出。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月4日
  1. The Decoder
    中国 AI 模型在敏感话题上照搬官方立场或拒绝回答

    Aleph Alpha 测试 967 个敏感话题发现,Qwen、DeepSeek、Kimi 等中国模型仅 17%–41% 的回答被评为平衡,其余照搬官方立场或拒绝回答;DeepSeek V4 Pro 拒答三分之二的问题。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。