Ataraxos 以16块GPU击败Stratego史上最强棋手Pim Niemeijer
Carnegie Mellon、MIT、纽约大学与斯坦福团队研发的 AI Ataraxos 以15胜1负4和击败被认为是 Stratego 史上最强的棋手 Pim Niemeijer,训练只用了16块GPU和几千美元。
Carnegie Mellon、MIT、纽约大学与斯坦福团队研发的 AI Ataraxos 以15胜1负4和击败被认为是 Stratego 史上最强的棋手 Pim Niemeijer,训练只用了16块GPU和几千美元。
Microsoft Research 的机器学习管线可为美国本土 66,935 座变电站在潜在影响前 30-60 分钟生成位置级太空天气风险估计,评估期检测到近 80% 的重大太空天气事件。
MindTopo 是 Microsoft Research 提出的新 benchmark,用连续性、分离、顺序、包围、打结五类任务评测多模态大语言模型的拓扑空间推理能力。测试显示各模型静态识别明显优于交互规划,且两者都远低于人类水平;规划失误多发生在场景已被理解之后,模型会丢失结构关系或提出违反环境动力学的动作。
Berkeley AI Research 提出 ABBEL 框架,用自然语言信念状态取代完整交互历史作为智能体工作上下文,并通过信念评分监督摘要内容。
Berkeley AI Research 发布长文综述自适应并行推理(APR),分析让模型自行决定何时分解子任务、开多少并发线程、如何协调线程的研究进展。