跳到正文
  1. NVIDIA Blog64

    GPT-6 Astra Ultrafast 基于 NVIDIA Blackwell GPU 上线 OpenAI API,token 生成提速最高 8x

    GPT-6 Astra Ultrafast 运行在 NVIDIA Blackwell GPU 上,现已在 OpenAI API 开放,并面向符合条件的 ChatGPT Work 和 Codex 用户,token 生成速度比 Astra Standard 模式最高快 8x。

    推荐理由:原文对比了 Ultrafast 与 Standard 模式的速度差距,并说明更快的 token 生成如何嵌入智能体的编码循环。

  1. Google DeepMind80

    Google DeepMind 发布前沿模型 Gemini 4 Argon

    Google DeepMind 发布前沿模型 Gemini 4 Argon,输出 token 上限从 64K 提升至 1M,介绍价为每百万输入 token 2 美元、输出 10 美元,缓存输入按输入价 95% 折扣。

    推荐理由:文章给出 1M 输出 token 与分阶段放量的思路,读者可据此判断长程任务能力如何与安全节奏配套。

  1. Google DeepMind63

    Google DeepMind 发布 SynthID Bio,为 AI 生成蛋白质添加水印

    Google DeepMind 发布 SynthID Bio,把水印技术带入合成生物学,可在氨基酸序列和预测 3D 结构坐标中嵌入不可感知的签名,并在实验室测试中保持蛋白质的生物学功能。

    推荐理由:原文给出了湿实验验证数据与 DNA 合成筛查场景,读者可据此理解水印如何在不损害蛋白功能的前提下进入生物安全防线。

  1. GitHub Blog · AI & ML62

    GitHub Copilot 撰文讨论聊天框何时是错误的界面

    GitHub Copilot 官方博客提出聊天往往是错误的 UI,主张让用户按任务现场生成自定义 canvas。

    推荐理由:作者解释了聊天成为默认界面的原因,并结合 Winget 和 SQLite 等 canvas 实例,给出何时该改用自定义界面的判断。

  2. Google DeepMind64

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,口型同步覆盖 97 种语言

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,为原生实时对话模型加入近实时视频生成的可视化形象,同步起在 Gemini Enterprise 中开放。

    推荐理由:文中说明了异步工具调用与语音对话并行的实现方式,对做企业级语音智能体的读者有直接参考价值。

  1. Google DeepMind70

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 两款语音生成模型

    Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零生成角色声音,并逐行控制表演提示、节奏、口音变化与接话插话。

    推荐理由:文中给出 Hume AI 与 Voice Arena 的具体名次和分数,读者可据此判断这两款 TTS 相对现有方案的水平。

  1. GitHub Blog · AI & ML74

    GitHub Copilot 用 Copilot 将 80 万行运行时从 TypeScript 重写为 Rust

    GitHub 借助 GitHub Copilot app 和 Copilot CLI,把 Copilot agent 运行时从 TypeScript 重写为超过 800,000 行生产 Rust,128 个 PR 合入 main,8 月 21 日运行时达到 100% Rust,性能提升若干数量级。

    推荐理由:原文用会话日志量化了智能体写代码时的探索比例与编译器报错分布,并给出原地原子替换的迁移方法,可迁移到其他大规模重构。

  1. Google DeepMind74

    Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型

    Google DeepMind 发布两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,面向语音智能体带来近实时推理升级。

    推荐理由:两个版本的分工和基准分数写得很清楚,读者可以直接据此判断自己的语音场景该选哪一档。

  1. GitHub Blog · AI & ML68

    GitHub 营销负责人用 Copilot 把活动全流程自动化,从建 Issue 到会后报告

    GitHub 日韩市场营销负责人 Tomoko Tanaka 用 GitHub Copilot 把活动从筹备到会后跟进的流程自动化,原本手工拼几天的搭建如今由一个 GitHub Issue 触发完成。

    推荐理由:文章给出把日常流程写成 runbook 交给 Copilot 执行的完整路径,其中用一个 DRY_RUN 开关先演练再上线的做法可迁移到其他自动化。

  1. Google DeepMind73

    Google DeepMind 发布 WeatherNext 3,天气预报分辨率提升至 5 公里

    Google DeepMind 与 Google Research 发布 WeatherNext 3,据 Brightband 独立实时评测是迄今最先进准确的全球天气 AI 模型,每小时基于实时卫星数据生成一次预报。

    推荐理由:模型改为直接学习实时卫星与站点观测,读者可据此看清它与依赖 NWP 数据的前代模型在训练来源上的差异。

已经到底了