Gemini 4 Argon 发布,Google DeepMind 重回前沿并支持 1M 输出
Google DeepMind 发布 Gemini 4 Argon,面向编程、企业知识工作与网络防御,借助新 API 功能 Long Decode Continuation 把输出上限提到 1M tokens,初期仅通过 Fairwind 项目向政府用户和可信网络防御者开放。
Google DeepMind 发布 Gemini 4 Argon,面向编程、企业知识工作与网络防御,借助新 API 功能 Long Decode Continuation 把输出上限提到 1M tokens,初期仅通过 Fairwind 项目向政府用户和可信网络防御者开放。
OpenAI 取消了原定下月发布 GPT-6.1 的计划,称测试显示该模型相比前代模型出现安全回归,此事由 The Wall Street Journal 先行报道并获 OpenAI 向媒体确认。
推荐理由:原文说明 GPT-6.1 在无人干预完成任务上更强,却在对齐测试中退步,可帮助读者理解性能与安全的取舍。
Google DeepMind 发布 Gemini 3.7 Flash,称其为面向编码与智能体的最强主力模型,发布价为 3.6 Flash 的一半,即每 1M 输入 token $0.75、输出 $3.75,优惠价持续到年底。
推荐理由:距离 3.6 Flash 仅三周发布,价格降到一半且多项基准有两位数提升,可据此判断 Flash 系列的迭代节奏与成本变化。
Google DeepMind 发布 Gemini Robotics 2 系列,包含三个模型:Gemini Robotics 2 视觉-语言-动作模型(VLA)可从脚到手指控制完整人形机器人与双臂机器人,Gemini Robotics ER 2 具身推理模型负责理解指令、规划多步任务,Gemini Robotics On-Device 2 则针对本地运行优化。
推荐理由:三个模型分别对应全身控制、具身推理与端侧适配,读者可据此看清具身智能落地的分层架构。
Google DeepMind 发布轻量网络安全模型 Gemini 3.5 Flash Cyber,基于 Gemini 3.5 Flash 微调,用于快速发现、验证并修补漏洞。