Gemini 4 Argon 发布,Google DeepMind 重回前沿并支持 1M 输出
Google DeepMind 发布 Gemini 4 Argon,面向编程、企业知识工作与网络防御,借助新 API 功能 Long Decode Continuation 把输出上限提到 1M tokens,初期仅通过 Fairwind 项目向政府用户和可信网络防御者开放。
Google DeepMind 发布 Gemini 4 Argon,面向编程、企业知识工作与网络防御,借助新 API 功能 Long Decode Continuation 把输出上限提到 1M tokens,初期仅通过 Fairwind 项目向政府用户和可信网络防御者开放。
GPT-6 Astra 完成一个 50-tab 税务工作簿的速度是 GPT-5.6 Sol 的 2 倍。它对用户意图的理解更强,让 Basis 对真实场景中的使用更有信心。
Anthropic 发布 Claude Opus 5.5,OpenAI 约一小时后发布 GPT-6 Sol 和 GPT-6 Luna,多家模型定价普遍下调。
推荐理由:作者用一张横向定价表和自己跑的实测,呈现了三款新模型的价格变化与 max 档的实际表现。
Parallel 借 GPT-6 Astra 让其智能体研究并综合劳动力市场数据,耗时较此前模型减半,成本同样降至一半。GPT-6 Astra 由此把同等任务的时间与开销同步压缩到原来的一半。
Xiaomi 发布 MiMo-V2.6 系列原生全模态模型,MiMo-V2.6-Pro 以 1.02T 总参数 / 42B 激活参数成为新的顶级开放权重模型,另有 MiMo-V2.6-Flash 与最高 20x 输出提速的 MiMo-V2.6-Pro-UltraSpeed。
推荐理由:文中给出 RL 训练的批量、上下文与 token 步长细节以及开源范围,便于判断开放 RL 环境的价值。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次提交中亮相,在 Qwen3-VL 上吞吐最高为 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高为 2.5 倍。