中国 AI 模型在敏感话题上照搬官方立场或拒绝回答
Aleph Alpha 测试 967 个敏感话题发现,Qwen、DeepSeek、Kimi 等中国模型仅 17%–41% 的回答被评为平衡,其余照搬官方立场或拒绝回答;DeepSeek V4 Pro 拒答三分之二的问题。
Aleph Alpha 测试 967 个敏感话题发现,Qwen、DeepSeek、Kimi 等中国模型仅 17%–41% 的回答被评为平衡,其余照搬官方立场或拒绝回答;DeepSeek V4 Pro 拒答三分之二的问题。
AINews 10/1-10/2 日报的头条是 OpenAI 推出 GPT-6.1 Sol,定价 $2/$10 每百万输入/输出 token,低于 Astra 的 $10/$50。
Google DeepMind 发布 Gemini 4 Argon,面向编程、企业知识工作与网络防御,借助新 API 功能 Long Decode Continuation 把输出上限提到 1M tokens,初期仅通过 Fairwind 项目向政府用户和可信网络防御者开放。
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准随机抽取的 100 个任务上测评多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。报告称这一水平已跨过明显门槛,此前的 Claude Opus 4.6 和 GLM-5.2 在这些任务上均未成功。
Opus 5.5 本周发布后社区口碑正面,并因大量用纯代码生成解释类视频而刷屏时间线。本期日报覆盖 12 个 subreddit、544 个 Twitter 账号。
GPT-6 Astra 完成一个 50-tab 税务工作簿的速度是 GPT-5.6 Sol 的 2 倍。它对用户意图的理解更强,让 Basis 对真实场景中的使用更有信心。
MentalHealthBench 是一个由专家参与设计的 benchmark,用于评估 AI 在真实心理健康对话中的回答是否既有帮助又安全。OpenAI 以“Introducing MentalHealthBench”的形式公布了这一评测基准,聚焦心理健康对话场景下的模型表现。
Anthropic 发布 Claude Opus 5.5,OpenAI 约一小时后发布 GPT-6 Sol 和 GPT-6 Luna,多家模型定价普遍下调。
推荐理由:作者用一张横向定价表和自己跑的实测,呈现了三款新模型的价格变化与 max 档的实际表现。
Parallel 借 GPT-6 Astra 让其智能体研究并综合劳动力市场数据,耗时较此前模型减半,成本同样降至一半。GPT-6 Astra 由此把同等任务的时间与开销同步压缩到原来的一半。
Xiaomi 发布 MiMo-V2.6 系列原生全模态模型,MiMo-V2.6-Pro 以 1.02T 总参数 / 42B 激活参数成为新的顶级开放权重模型,另有 MiMo-V2.6-Flash 与最高 20x 输出提速的 MiMo-V2.6-Pro-UltraSpeed。
推荐理由:文中给出 RL 训练的批量、上下文与 token 步长细节以及开源范围,便于判断开放 RL 环境的价值。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次提交中亮相,在 Qwen3-VL 上吞吐最高为 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高为 2.5 倍。
Google DeepMind 宣布试点全球首个针对专有前沿模型的双盲评测,与 Singapore AI Safety Institute、OpenMined、AVERI、MLCommons 合作,在隐私保护环境中用保密基准测试 Gemini Flash Lite 模型。
Microsoft Research 开源智能体训练框架 Orchard,核心是基于 Kubernetes 的可复用环境服务 Orchard Env,支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中直接训练智能体,并同步发布训练数据与评测方法。
推荐理由:环境层与三套训练配方一并开源,读者可以据此判断小参数模型在真实 harness 中训练能达到什么水平。