跳到正文
  1. Latent Space79

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 与 Decisions API 等更新

    OpenAI 在 DevDay 2026 发布常驻智能体 Dots、模型 GPT-6.1 Sol,以及 Decisions API、ChatGPT Spaces、Marketplace 等平台更新。

    推荐理由:文章汇总了 DevDay 的全部发布并附上多方独立评测数据,可据此对比 GPT-6.1 Sol 与 Astra、Opus 5.5 的价格和能力差距。

  1. Simon Willison80

    OpenAI DevDay 2026 现场直播:发布 Dots 智能体与 GPT-6.1 Sol

    Simon Willison 在 OpenAI DevDay 2026 现场逐条直播主旨演讲,OpenAI 发布了个人智能体 Dots 和新模型 GPT-6.1 Sol。

    推荐理由:现场时间线覆盖发布会全部关键节点,作者的即时点评点出哪些功能在对标竞品,便于读者判断与自己相关的变化。

  1. Google DeepMind64

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,口型同步覆盖 97 种语言

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,为原生实时对话模型加入近实时视频生成的可视化形象,同步起在 Gemini Enterprise 中开放。

    推荐理由:文中说明了异步工具调用与语音对话并行的实现方式,对做企业级语音智能体的读者有直接参考价值。

  1. NVIDIA Blog63

    NVIDIA 发布 Isaac ROS 5.0,为机器人开发加入智能体工作流

    NVIDIA 在加拿大多伦多 ROSCon 发布开源免费的 Isaac ROS 5.0,为机器人开发引入智能体工作流与新平台支持。

    推荐理由:原文列出智能体技能与生态伙伴的接入方式,读者可看到 AI 智能体嵌入机器人开发的具体路径。

  1. GitHub Blog · AI & ML62

    GitHub Copilot 推出 Project HydraFusion 研究预览:多模型编排带来接近 Claude Opus 5 的质量与更低成本

    GitHub Copilot 在 CLI 中以 /experimental 开启 Project HydraFusion 研究预览,全计划可用,它在运行时从多家供应商的模型里生成执行计划,按质量、成本和延迟自动选择 Single、Cascade、Critique 三种执行模式之一。

    推荐理由:三个基准的成本与质量对照数据齐全,读者可据此判断多模型编排在什么任务上划算、在什么任务上有损失。

  1. Google DeepMind71

    Gemini 推出 agentic video understanding,token 消耗最多降 88%

    Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上线 agentic video understanding 视频分析功能,token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。

    推荐理由:官方给出了 token、成本与准确率的具体变化和 API 启用方式,便于判断它会怎样改变长视频分析的成本结构。

  1. Google DeepMind65

    Gemini Omni 1.1 Flash 发布,新增场景延长与首尾帧插值等视频控制能力

    Gemini Omni 1.1 Flash 发布,新增场景延长、首尾帧插值、360p 快速草稿、4K 上采样和视频参考五项创意控制,已通过 Gemini API 在 Google AI Studio 与 Agent Platform API 开放。

    推荐理由:逐项给出五项新控制能力与对应 API 用法,方便开发者判断是否把生成视频流程迁到 Omni 1.1。

  1. Microsoft Research71

    Microsoft Research 开源智能体训练框架 Orchard,小参数模型在 SWE-bench Verified 达 69.7%

    Microsoft Research 开源智能体训练框架 Orchard,核心是基于 Kubernetes 的可复用环境服务 Orchard Env,支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中直接训练智能体,并同步发布训练数据与评测方法。

    推荐理由:环境层与三套训练配方一并开源,读者可以据此判断小参数模型在真实 harness 中训练能达到什么水平。

  1. Google DeepMind68

    Gemini 3.5 Flash 内置 computer use 智能体操作能力

    Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前它只作为独立的 Gemini 2.5 computer use 模型提供,现在已原生集成进主打的 Gemini Flash 模型。

    推荐理由:原文说明了功能从独立模型到内置的路径和两项可选企业防护,读者可据此评估接入与安全权衡。

  1. Google DeepMind73

    Gemini 3.5 Live Translate 发布,支持 70+ 语言近实时语音翻译

    Google DeepMind 发布最新音频模型 Gemini 3.5 Live Translate,可自动检测 70+ 语言并连续生成流畅自然的译音,保留说话人的语调、节奏和音高,全程只落后说话人几秒。

    推荐理由:解释了连续生成与等待上下文之间的取舍,读者可据此理解近实时同传的延迟表现。

已经到底了