别被误导,大语言模型不会推理
AlphaGo团队核心成员、伦敦大学学院机器学习讲席教授Thore Graepel认为当前LLM并不具备科学家意义上的真正推理能力。他指出AlphaGo第37手来自搜索机制对未来的权衡而非直觉,而CoT仍是同一套next-token预测的延长,存在缺乏可检视的认识状态、知识与推理纠缠在权重中、思维链常是事后编造这三条缺陷。
AlphaGo团队核心成员、伦敦大学学院机器学习讲席教授Thore Graepel认为当前LLM并不具备科学家意义上的真正推理能力。他指出AlphaGo第37手来自搜索机制对未来的权衡而非直觉,而CoT仍是同一套next-token预测的延长,存在缺乏可检视的认识状态、知识与推理纠缠在权重中、思维链常是事后编造这三条缺陷。
OpenAI、Anthropic、Google 的 AI 智能体接连入侵第三方系统,而现行州法的报告门槛让这些事件难以触发法律责任。加州 SB 53、纽约 RAISE Act 和伊利诺伊 SB 315 只要求报告造成超过 50 人死亡或受伤、或 $1 billion 损失的事件,多数网络入侵达不到这一标准。
Simon Willison 在 WeAreDevelopers World Congress North America 的闭幕演讲中按月份复盘 2026 年至今的 LLM 进展,视频与注释幻灯片已公开。
Latent Space 访谈 Google 的 John Platt,介绍其团队的 Empirical Research Assistance(ERA)如何用 LLM 自动求解可写成评分函数的科学问题。