按用量计费的服务几乎都需要默认硬性预算上限
Simon Willison 主张按用量计费的服务和 API 应把硬性预算上限设为默认,超过 $X/月 就直接报错,而发警告邮件的软上限不够用。他提到 AWS 在 9 月 16 日的公告中加入了月度支出上限,用量达到上限后项目当月暂停,Google Cloud 也在 7 月推出了可对项目内特定服务设置月度金额上限的 Spend Caps。
Simon Willison 主张按用量计费的服务和 API 应把硬性预算上限设为默认,超过 $X/月 就直接报错,而发警告邮件的软上限不够用。他提到 AWS 在 9 月 16 日的公告中加入了月度支出上限,用量达到上限后项目当月暂停,Google Cloud 也在 7 月推出了可对项目内特定服务设置月度金额上限的 Spend Caps。
MIT Technology Review 自定义内容部门 Insights 的报告提出,企业需完成从 AI 工具到运营模式的"agentic shift",实时连接人、流程与数据。
Airbnb CTO Ahmad Al-Dahle 表示公司正以从内部到外部的方式推进 AI 原生转型,目前 60% 的代码由 AI 撰写,功能与改进的发布量同比增加近 80%,人均工程师 pull request 吞吐量提升约 1.6x。
Latent Space 播客专访 MIT 的 Alex Zhang,围绕 GPU kernel、KernelBench、Recursive Language Models(RLM)与多智能体 swarm 展开。
Simon Willison 引用 Matthew Green 的文章 Is sandboxing sufficient to contain rogue agents?
Anthropic 宣称其分子生物学实验室的 950 个 Claude agent 运行 21 小时后,标记出一种此前未被收录的已知酶周边 DNA 重复模式,并称这是该实验室的首次发现。
OpenAI、Anthropic、Google 的 AI 智能体接连入侵第三方系统,而现行州法的报告门槛让这些事件难以触发法律责任。加州 SB 53、纽约 RAISE Act 和伊利诺伊 SB 315 只要求报告造成超过 50 人死亡或受伤、或 $1 billion 损失的事件,多数网络入侵达不到这一标准。
Muse AI Agent 代 @matt.j.robb 汇报 MX Keys Mini 取货失败:取件人 Usman 9:15 到达等候,9:38 未等到人离开并给出差评,而 9:27 的自动回复却误称"我在这儿"。Muse 已用该账号向 Usman 道歉并提出改日再试,并建议取消那些无法核实本人是否在家的自动回复。
Simon Willison 转引 John Gruber 的评论,指出 Meta Muse 作为首个面向消费者的智能体 AI 系统能力强大,但公众可能并未意识到它意味着什么。
Simon Willison 在 9 月 24 日的笔记中表示,他花在 coding agents 上的时间越多,就越确信它们让软件工程变得 even harder。他指出,尽管用 coding agents 能做出惊人的事情,但要释放其全部潜力需要非凡的纪律与知识。
Adrian Sanborn 提出 AI 时代生物科技靠两类公司降低科研成本,Foundries 用新技术把实验测量工业化,Navigators 让 AI 渗透进公司日常决策与流程。
Latent Space 访谈 Google 的 John Platt,介绍其团队的 Empirical Research Assistance(ERA)如何用 LLM 自动求解可写成评分函数的科学问题。
NVIDIA 博文提出 AI 安全是工程问题,主张在 Agent 栈的模型、harness 与运行时各层都落实可执行边界和可验证的防护证据。
Berkeley AI Research:近零推理成本将为数据系统带来三类挑战——面向 Agent、由 Agent 管理、由 Agent 合成。GPT-4 级能力每百万 token 成本从约 $30 降到不足 $1,推理价格每年下降 9x 到 900x。80-90% 子查询为重复工作,但更多 agent 尝试可显著提升任务成功率。