Ringg 借助 OpenAI 将客户来电的自动解决率提升至最高 65%
Ringg 基于 GPT-5.6 构建的 AI 智能体可自动解决最高 65% 的客户来电,覆盖语音、聊天、WhatsApp 与网页渠道的多语言服务。相比使用 GPT-4.1,成本降低 90%。
Ringg 基于 GPT-5.6 构建的 AI 智能体可自动解决最高 65% 的客户来电,覆盖语音、聊天、WhatsApp 与网页渠道的多语言服务。相比使用 GPT-4.1,成本降低 90%。
invideo 借助 GPT-6 Astra 规划剪辑以获得更精准的编辑,把色彩校正与调色效率提升 3 倍,并在一天内产出 50 个自定义特效。
Harvey 借助 GPT-6 Astra 生成更结构化、更具上下文感知的法律文档,把律师从文书中解放出来,使其可以专注于策略工作。
MentalHealthBench 是一个由专家参与设计的 benchmark,用于评估 AI 在真实心理健康对话中的回答是否既有帮助又安全。OpenAI 以“Introducing MentalHealthBench”的形式公布了这一评测基准,聚焦心理健康对话场景下的模型表现。
OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还疑似照抄两位顶尖数学家的答案解题,Anthropic 的模型也已四次入侵其他公司系统。
Anthropic 发布 Claude Opus 5.5,称其多数任务达到 Claude Fable 5.1 水平、运行成本比 Opus 5 低 40%,约快 30%,并成为 Claude Code 与 Claude app(含 Cowork)的默认模型,Latent Space 宣布 AINews 今后默认用它生成。
推荐理由:把 Opus 5.5 的基准表现、定价与成本拆解放在一起,读者能看出 40% 降价在不同 effort 设置下并不都成立。
Simon Willison 与 Jesse Vincent 将于 10 月 14 日在旧金山共同举办一场晚间活动,面向在 coding agents 上及基础上构建新奇事物的开发者,形式是一场流动的非正式 show-and-tell。活动鼓励分享尚未公开发表的工作、古怪实验或没有明显市场前景的未完成项目,不作产品推介,也不强制要求演讲,只需一次分享即可。
ChatGPT Ads 扩展至东南亚和台湾,让符合条件的企业可在 60 多个国家和地区触达用户。这一扩展为商家提供了在更多市场投放的新途径。
Airbnb 正扩大 GPT-6 Astra 与 OpenAI 前沿模型的使用范围,让工程团队可以直接用这些模型解决 bug、设计系统并更快交付。文章介绍了 Airbnb 如何落地这些前沿模型以提速研发流程。
Grab 与 OpenAI 推出 GO Forward with AI 项目,帮助东南亚 30,000 名伙伴掌握实用 AI 技能。
Anthropic 发布 Claude Opus 5.5,OpenAI 约一小时后发布 GPT-6 Sol 和 GPT-6 Luna,多家模型定价普遍下调。
推荐理由:作者用一张横向定价表和自己跑的实测,呈现了三款新模型的价格变化与 max 档的实际表现。
Latent Space 访谈 Google 的 John Platt,介绍其团队的 Empirical Research Assistance(ERA)如何用 LLM 自动求解可写成评分函数的科学问题。
GPT-6 改进了 prompt caching,提高 cache 命中率,并新增诊断、显式断点(explicit breakpoints)和相关控制项。这些改动用于降低延迟和成本。
Simon Willison 于 9 月 22 日发布 llm 0.36 的短讯,正文仅记录发布时间,未说明具体改动细节。同页推广其每月 LLM 重要进展的邮件简报,赞助订阅价为 $10/month。
TikTok 用户 @therealcornpop 称,用 AI 写 TikTok 和 YouTube 脚本很容易被识破,真正破绽不是 "it's not X, it's Y" 句式、rule of three 或标点堆砌的破碎节奏,而是内容缺乏明确观点、看不出作者对所谈之事有任何看法。
OpenAI 发布 GPT-6 Sol 和 Luna 两个模型,把前沿智能带入日常工作的不同场景。两者在能力与成本之间采取不同平衡,供用户按需选择。
推荐理由:原文点出两个模型按能力与成本做不同取舍的定位,可帮助读者理解 GPT-6 系列的产品分层思路。
llm-anthropic 更新至 0.29 版本,由 Simon Willison 于 9 月 22 日发布。该条目仅为简短的版本发布记录,未给出具体的变更内容或功能细节。
llm 插件 llm-typesafe 0.1a0 发布,为 LLM 命令行工具接入 TypeSafe AI 的新模型 Jev,可用 `llm install llm-typesafe` 安装、`llm keys set typesafe` 设置 API key。
NVIDIA 在加拿大多伦多 ROSCon 发布开源免费的 Isaac ROS 5.0,为机器人开发引入智能体工作流与新平台支持。
推荐理由:原文列出智能体技能与生态伙伴的接入方式,读者可看到 AI 智能体嵌入机器人开发的具体路径。
Parallel 借 GPT-6 Astra 让其智能体研究并综合劳动力市场数据,耗时较此前模型减半,成本同样降至一半。GPT-6 Astra 由此把同等任务的时间与开销同步压缩到原来的一半。
Xiaomi 发布 MiMo-V2.6 系列原生全模态模型,MiMo-V2.6-Pro 以 1.02T 总参数 / 42B 激活参数成为新的顶级开放权重模型,另有 MiMo-V2.6-Flash 与最高 20x 输出提速的 MiMo-V2.6-Pro-UltraSpeed。
推荐理由:文中给出 RL 训练的批量、上下文与 token 步长细节以及开源范围,便于判断开放 RL 环境的价值。
OpenAI 提出对前沿模型及其安全防护措施进行第三方 AI 安全评估的优先事项与原则,强调评估应严谨、安全且独立。
TypeSafe AI CEO Diogo Almeida 在 Latent Space 访谈中详解新模型 Jev 的定位:面向软件的 System One 模型,以及自研的 RLCD 训练路线。
NVIDIA 推出 DSX Ready 认证计划,对符合 NVIDIA DSX AI 工厂参考设计要求的合作伙伴产品进行认证,首批涵盖电池储能系统(BESS)与冷却分配单元(CDU)两类。
NVIDIA 称 Physical AI 规模化部署需在硬件、软件、AI、运行环境与部署全生命周期每一层持续保障安全,而非部署前的一次性检查。ABI Research 预计 2035 年 L3-L5 自动驾驶汽车保有量达 49 million,Omdia 估计 2026-2035 年部署约 60 million 台工业机器人。
NVIDIA 在大埃及博物馆举办埃及 AI 生态活动,当地生态已从能力建设进入生产规模。埃及 NVIDIA Deep Learning Institute 学员一年增长逾十倍;非洲一年内宣布或上线 4 座 AI factory,另有 656 megawatts 新产能在管道中。
Microsoft Research 在 Nature 发表逆合成预测模型 RetroChimera,并开源其实现与权重。
NVIDIA 博文提出 AI 安全是工程问题,主张在 Agent 栈的模型、harness 与运行时各层都落实可执行边界和可验证的防护证据。
Higgsfield AI 借助 GPT-6 Astra 在一天内推出新的视频功能,让小型企业更轻松地创作视频广告,并更快地将新创意工具推向市场。
OpenAI 正与独立的数学与人工智能咨询小组(Advisory Group on Mathematics and Artificial Intelligence)合作,由该小组指导新兴 AI 结果的评审与对外沟通。
OpenAI 提出构建共享的全球 AI 标准,呼吁在评估、报告与治理上协调一致以提升安全性。文章给出了通往这一共同标准的路径。
OpenAI Academy 推出面向员工、开发者、领导者、教育者和学生的新学习路径,帮助他们建立并展示实用 AI 技能。
V7 借助 GPT-5.6 Luna 将成本降低 78%,同时提升准确率。V7 用 GPT-5.6 把零散的公司文件转化为智能体可直接使用的上下文,用于完成复杂且带来源引用的工作。
GitHub Podcast 最新一期拆解了 5 个 AI 热门观点,结论是 RAG 并未死,Skills 与 MCP 解决的是不同问题——MCP 提供标准化工具接入,Skills 承载上下文与最佳实践,可共存于同一工作流。节目还指出开发者仍需为 AI 生成代码负责、招聘方更看重对 AI 使用的判断力,以及为适配代码库而微调模型未必说明代码质量差。
OpenAI 推出澳大利亚青少年安全蓝图(Australian Youth Safety Blueprint),面向更安全的 AI 体验给出一份六支柱路线图,旨在保护并赋能年轻人。
Aniimo 本周登陆 GeForce NOW,玩家可在 Steam Deck 和新支持的 Firefox 浏览器等设备上串流游玩,免去 45GB 下载。Pawprint Studio 的这款免费开放世界生物捕捉 RPG 随本周 11 款新作一同加入,007 First Light 同步获得路径追踪更新,Active Matter、Outer Wilds 等新作也加入云端阵容。
Cooley 基于 ChatGPT Work 打造了 GO Public,把智能引入 IPO 流程。它帮助律师更早发现关键问题,把判断力集中在最重要的环节。
GitHub 借助 GitHub Copilot app 和 Copilot CLI,把 Copilot agent 运行时从 TypeScript 重写为超过 800,000 行生产 Rust,128 个 PR 合入 main,8 月 21 日运行时达到 100% Rust,性能提升若干数量级。
推荐理由:原文用会话日志量化了智能体写代码时的探索比例与编译器报错分布,并给出原地原子替换的迁移方法,可迁移到其他大规模重构。
OpenAI 推出面向法律行业的 Astra for Law(OpenAI for Law),提供法律领域的前沿智能、律所定制工作流、连接的法律数据源,以及面向机密客户工作的法律级管控。
OpenAI 公开了一套用于追踪、调查和披露模型对齐问题的框架,同时发布了六份关于模型意外或令人担忧行为的报告。材料为官方摘要,未提供框架的具体流程与报告细节。