跳到正文
9月21日周一
9月18日周五
  1. GitHub Blog · AI & ML32

    GitHub Podcast:该不该读 AI 生成的代码、RAG 死了吗、Skills 干掉 MCP 了吗

    GitHub Podcast 最新一期拆解了 5 个 AI 热门观点,结论是 RAG 并未死,Skills 与 MCP 解决的是不同问题——MCP 提供标准化工具接入,Skills 承载上下文与最佳实践,可共存于同一工作流。节目还指出开发者仍需为 AI 生成代码负责、招聘方更看重对 AI 使用的判断力,以及为适配代码库而微调模型未必说明代码质量差。

9月17日周四
  1. NVIDIA Blog22

    可爱生物登陆云端:Aniimo 上线 GeForce NOW

    Aniimo 本周登陆 GeForce NOW,玩家可在 Steam Deck 和新支持的 Firefox 浏览器等设备上串流游玩,免去 45GB 下载。Pawprint Studio 的这款免费开放世界生物捕捉 RPG 随本周 11 款新作一同加入,007 First Light 同步获得路径追踪更新,Active Matter、Outer Wilds 等新作也加入云端阵容。

  2. GitHub Blog · AI & ML74

    GitHub Copilot 用 Copilot 将 80 万行运行时从 TypeScript 重写为 Rust

    GitHub 借助 GitHub Copilot app 和 Copilot CLI,把 Copilot agent 运行时从 TypeScript 重写为超过 800,000 行生产 Rust,128 个 PR 合入 main,8 月 21 日运行时达到 100% Rust,性能提升若干数量级。

    推荐理由:原文用会话日志量化了智能体写代码时的探索比例与编译器报错分布,并给出原地原子替换的迁移方法,可迁移到其他大规模重构。

  3. OpenAI News29

    OpenAI 推出 Astra for Law

    OpenAI 推出面向法律行业的 Astra for Law(OpenAI for Law),提供法律领域的前沿智能、律所定制工作流、连接的法律数据源,以及面向机密客户工作的法律级管控。

9月16日周三
9月14日周一
9月12日周六
  1. GitHub Blog · AI & ML68

    GitHub 营销负责人用 Copilot 把活动全流程自动化,从建 Issue 到会后报告

    GitHub 日韩市场营销负责人 Tomoko Tanaka 用 GitHub Copilot 把活动从筹备到会后跟进的流程自动化,原本手工拼几天的搭建如今由一个 GitHub Issue 触发完成。

    推荐理由:文章给出把日常流程写成 runbook 交给 Copilot 执行的完整路径,其中用一个 DRY_RUN 开关先演练再上线的做法可迁移到其他自动化。

9月11日周五
9月10日周四
9月8日周二
  1. Google DeepMind68

    Google DeepMind 发布 AlphaGenome Atlas:人类基因组 90 亿种单碱基变异的预测图谱

    Google DeepMind 推出 AlphaGenome Atlas 平台,预先计算并开放人类基因组约 9 billion 个单核苷酸变异的效应预测,含配套论文、免费网站门户和 AlphaGenome API。

    推荐理由:原文把数据规模与 AlphaFold 数据库对比,读者可据此理解这次开放的资源在生命科学研究中的定位。

9月5日周六
  1. GitHub Blog · AI & ML62

    GitHub Copilot 推出 Project HydraFusion 研究预览:多模型编排带来接近 Claude Opus 5 的质量与更低成本

    GitHub Copilot 在 CLI 中以 /experimental 开启 Project HydraFusion 研究预览,全计划可用,它在运行时从多家供应商的模型里生成执行计划,按质量、成本和延迟自动选择 Single、Cascade、Critique 三种执行模式之一。

    推荐理由:三个基准的成本与质量对照数据齐全,读者可据此判断多模型编排在什么任务上划算、在什么任务上有损失。

9月3日周四
  1. Google DeepMind73

    Google DeepMind 发布 WeatherNext 3,天气预报分辨率提升至 5 公里

    Google DeepMind 与 Google Research 发布 WeatherNext 3,据 Brightband 独立实时评测是迄今最先进准确的全球天气 AI 模型,每小时基于实时卫星数据生成一次预报。

    推荐理由:模型改为直接学习实时卫星与站点观测,读者可据此看清它与依赖 NWP 数据的前代模型在训练来源上的差异。

  2. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber 两个新模型,均基于同一核心智能,定价与 3.7 Flash 相同,为 $0.75 per million input tokens 和 $3.75 per million output tokens。

    推荐理由:文中列出的多项基准成绩与每百万 token 定价,便于读者横向比较新模型的能力与成本。

9月2日周三
  1. Google DeepMind71

    Gemini 推出 agentic video understanding,token 消耗最多降 88%

    Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上线 agentic video understanding 视频分析功能,token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。

    推荐理由:官方给出了 token、成本与准确率的具体变化和 API 启用方式,便于判断它会怎样改变长视频分析的成本结构。

9月1日周二
8月28日周五
  1. Google DeepMind65

    Gemini Omni 1.1 Flash 发布,新增场景延长与首尾帧插值等视频控制能力

    Gemini Omni 1.1 Flash 发布,新增场景延长、首尾帧插值、360p 快速草稿、4K 上采样和视频参考五项创意控制,已通过 Gemini API 在 Google AI Studio 与 Agent Platform API 开放。

    推荐理由:逐项给出五项新控制能力与对应 API 用法,方便开发者判断是否把生成视频流程迁到 Omni 1.1。

8月27日周四
  1. Google DeepMind69

    Google DeepMind 发布 Gemini 3.5 Transcribe 语音转写模型

    Google DeepMind 发布语音转写模型 Gemini 3.5 Transcribe,据 Artificial Analysis 测量其流式场景平均 WER 为 4.0%,非流式为 2.6%,最终转写耗时相比 Chirp 3 改善 70%,FLEURS 基准上流式与非流式 WER 分别为 5.50% 和 5.04%。

    推荐理由:原文给出流式与非流式的 WER 数据和相比 Chirp 3 的延迟改进,读者可据此评估它能否替代现有语音转写方案。

8月21日周五
8月14日周五
  1. Google DeepMind75

    Google DeepMind 发布 Gemini 3.7 Flash,主打编码与智能体的高性价比

    Google DeepMind 发布 Gemini 3.7 Flash,称其为面向编码与智能体的最强主力模型,发布价为 3.6 Flash 的一半,即每 1M 输入 token $0.75、输出 $3.75,优惠价持续到年底。

    推荐理由:距离 3.6 Flash 仅三周发布,价格降到一半且多项基准有两位数提升,可据此判断 Flash 系列的迭代节奏与成本变化。

8月13日周四
  1. Microsoft Research39

    MindTopo 揭示 VLM 的空间推理能力

    MindTopo 是 Microsoft Research 提出的新 benchmark,用连续性、分离、顺序、包围、打结五类任务评测多模态大语言模型的拓扑空间推理能力。测试显示各模型静态识别明显优于交互规划,且两者都远低于人类水平;规划失误多发生在场景已被理解之后,模型会丢失结构关系或提出违反环境动力学的动作。

8月12日周三
  1. Google DeepMind69

    Google DeepMind 发布手语翻译模型 SL2T,落地 Gboard 与 Live Transcribe

    Google DeepMind 发布多语言手语到文本翻译模型 SL2T,首次将手语 AI 带入消费级产品,在 Pixel 11 的 Gboard 与 Live Transcribe 上提供 ASL 到英语的手语转文字听写,可用于搜索、撰写消息并向 Gemini 提问,后续将支持更多设备与语言。

    推荐理由:文中说明了手语翻译区别于语音转写的两大难点,以及用姿势坐标替代 gloss 的设计,便于理解方案取舍

8月6日周四
  1. Google DeepMind72

    Google DeepMind 开源 WeatherNext 气旋预报模型,三天预报精度相当于以往两天

    Google DeepMind 在 Nature 发表论文并开源 WeatherNext Cyclones、WeatherNext 2 和 WeatherNext 2-mini 三个模型,单一模型在气旋路径、强度与风场结构预报上达到 SOTA 精度,平均比以往模型多出超过 24 小时的提前量,三天预报精度相当于旧模型的两天。

    推荐理由:文中说明了单一模型同时处理路径与强度的做法,并给出比以往多出一天以上预警时间的量化口径,便于判断其应用价值。