跳到正文
今天10月5日周一7 条
10月4日周日
  1. Simon Willison58

    按用量计费的服务几乎都需要默认硬性预算上限

    Simon Willison 主张按用量计费的服务和 API 应把硬性预算上限设为默认,超过 $X/月 就直接报错,而发警告邮件的软上限不够用。他提到 AWS 在 9 月 16 日的公告中加入了月度支出上限,用量达到上限后项目当月暂停,Google Cloud 也在 7 月推出了可对项目内特定服务设置月度金额上限的 Spend Caps。

  2. Simon Willison16

    Simon Willison 发布 9 月赞助者专属 newsletter

    Simon Willison 于 10 月 3 日发出 9 月赞助者专属月度 newsletter,赞助者可凭专属链接阅读全文。本期主题包括 Fable class 模型、价格战、3D 图形与 Blender 和像素艺术、LLM 进军数学、针对 Datasette 的漏洞危机,以及 2026 in LLMs (so far) 等。月付 $10 可提前一个月阅读,8 月刊可作为预览。

10月3日周六
  1. The Verge · AI36

    Splice CEO Kakul Srivastava:AI 写的邮件正在扼杀对话

    Splice CEO Kakul Srivastava 认为 AI 写的邮件正在扼杀对话:一旦分不清文字背后是否还有人,围绕它的讨论就会变成另一场更糟的对话,而且无法回头。她把同样的态度用在音乐上,主张让 AI 产品保持人类在创作流程中心,并回避 Suno 那类"按键即得歌"的 AI。她最不可或缺的工具是写得好的文档和一场真实讨论——Splice 是 remote-first,没有走廊。

10月2日周五
  1. MIT Technology Review · AI57

    别被误导,大语言模型不会推理

    AlphaGo团队核心成员、伦敦大学学院机器学习讲席教授Thore Graepel认为当前LLM并不具备科学家意义上的真正推理能力。他指出AlphaGo第37手来自搜索机制对未来的权衡而非直觉,而CoT仍是同一套next-token预测的延长,存在缺乏可检视的认识状态、知识与推理纠缠在权重中、思维链常是事后编造这三条缺陷。

  2. NVIDIA Blog64

    GPT-6 Astra Ultrafast 基于 NVIDIA Blackwell GPU 上线 OpenAI API,token 生成提速最高 8x

    GPT-6 Astra Ultrafast 运行在 NVIDIA Blackwell GPU 上,现已在 OpenAI API 开放,并面向符合条件的 ChatGPT Work 和 Codex 用户,token 生成速度比 Astra Standard 模式最高快 8x。

    推荐理由:原文对比了 Ultrafast 与 Standard 模式的速度差距,并说明更快的 token 生成如何嵌入智能体的编码循环。

  3. Ars Technica · AI67

    联邦法官驳回 Chegg 和 Penske 针对 Google AI 搜索的反垄断诉讼

    美国联邦法官 Amit Mehta 驳回了 Chegg 和 Penske Media 对 Google 提起的反垄断诉讼,认定其行为不构成违法。两家公司指控 Google 在 AI Overviews 等产品中违规抓取内容导致流量下滑,诉讼于 2025 年提起。Mehta 认为网站对 Google 导流的期待并不构成协议,这只是通用搜索引擎的运作方式。