跳到正文
10月2日周五
  1. NVIDIA Blog64

    GPT-6 Astra Ultrafast 基于 NVIDIA Blackwell GPU 上线 OpenAI API,token 生成提速最高 8x

    GPT-6 Astra Ultrafast 运行在 NVIDIA Blackwell GPU 上,现已在 OpenAI API 开放,并面向符合条件的 ChatGPT Work 和 Codex 用户,token 生成速度比 Astra Standard 模式最高快 8x。

    推荐理由:原文对比了 Ultrafast 与 Standard 模式的速度差距,并说明更快的 token 生成如何嵌入智能体的编码循环。

10月1日周四
  1. Google DeepMind80

    Google DeepMind 发布前沿模型 Gemini 4 Argon

    Google DeepMind 发布前沿模型 Gemini 4 Argon,输出 token 上限从 64K 提升至 1M,介绍价为每百万输入 token 2 美元、输出 10 美元,缓存输入按输入价 95% 折扣。

    推荐理由:文章给出 1M 输出 token 与分阶段放量的思路,读者可据此判断长程任务能力如何与安全节奏配套。

9月30日周三
  1. AWS Machine Learning Blog73

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,为 agentic 编码、计算机使用和专业工作负载带来更强推理能力。

    推荐理由:文章给出 GPT-6.1 Sol 相对 GPT-6 Sol 的成本与成绩对比,以及 Bedrock 上的部署与数据控制项,便于评估引入代价。

9月29日周二
  1. OpenAI News70

    OpenAI 发布 GPT-6.1 Sol,价格为 Astra 的五分之一

    OpenAI 发布 GPT-6.1 Sol,定位是接近 Astra 智能水平的模型,面向编码、计算机使用和专业工作。其 API 输入和输出 token 价格为 Astra 标准价格的五分之一。

    推荐理由:原文点明它在编码与专业工作上接近 Astra 的能力,而 API 输入输出价格仅为其五分之一,读者可用这条价性比信息评估接入成本。

9月28日周一
9月27日周日
9月26日周六
9月25日周五
9月24日周四
  1. Simon Willison24

    用实时交互示例讲解 Shadow roots

    一个用 Fable 5.1 Medium 生成的交互式 artifact,以实时示例讲解 CSS 的 Shadow roots,覆盖样式封装、继承、slots、parts 与 JavaScript 访问。Shadow roots 会创建带有私有样式表和元素的隔离 DOM 树,与页面 DOM 以特定的受控方式交互。

9月23日周三
  1. Simon Willison16

    旧金山 10 月 14 日:Agentic Engineering 主题 Birds of a Feather 交流活动

    Simon Willison 与 Jesse Vincent 将于 10 月 14 日在旧金山共同举办一场晚间活动,面向在 coding agents 上及基础上构建新奇事物的开发者,形式是一场流动的非正式 show-and-tell。活动鼓励分享尚未公开发表的工作、古怪实验或没有明显市场前景的未完成项目,不作产品推介,也不强制要求演讲,只需一次分享即可。

9月22日周二
9月17日周四
  1. GitHub Blog · AI & ML74

    GitHub Copilot 用 Copilot 将 80 万行运行时从 TypeScript 重写为 Rust

    GitHub 借助 GitHub Copilot app 和 Copilot CLI,把 Copilot agent 运行时从 TypeScript 重写为超过 800,000 行生产 Rust,128 个 PR 合入 main,8 月 21 日运行时达到 100% Rust,性能提升若干数量级。

    推荐理由:原文用会话日志量化了智能体写代码时的探索比例与编译器报错分布,并给出原地原子替换的迁移方法,可迁移到其他大规模重构。

9月14日周一
9月12日周六
9月11日周五
9月5日周六
  1. GitHub Blog · AI & ML62

    GitHub Copilot 推出 Project HydraFusion 研究预览:多模型编排带来接近 Claude Opus 5 的质量与更低成本

    GitHub Copilot 在 CLI 中以 /experimental 开启 Project HydraFusion 研究预览,全计划可用,它在运行时从多家供应商的模型里生成执行计划,按质量、成本和延迟自动选择 Single、Cascade、Critique 三种执行模式之一。

    推荐理由:三个基准的成本与质量对照数据齐全,读者可据此判断多模型编排在什么任务上划算、在什么任务上有损失。

9月3日周四
  1. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 发布 Gemini 3.8 Flash 与 Gemini 3.8 Flash Cyber 两个新模型,均基于同一核心智能,定价与 3.7 Flash 相同,为 $0.75 per million input tokens 和 $3.75 per million output tokens。

    推荐理由:文中列出的多项基准成绩与每百万 token 定价,便于读者横向比较新模型的能力与成本。

8月14日周五
  1. Google DeepMind75

    Google DeepMind 发布 Gemini 3.7 Flash,主打编码与智能体的高性价比

    Google DeepMind 发布 Gemini 3.7 Flash,称其为面向编码与智能体的最强主力模型,发布价为 3.6 Flash 的一半,即每 1M 输入 token $0.75、输出 $3.75,优惠价持续到年底。

    推荐理由:距离 3.6 Flash 仅三周发布,价格降到一半且多项基准有两位数提升,可据此判断 Flash 系列的迭代节奏与成本变化。

7月21日周二
7月17日周五