Gary Marcus 评 GPT-6 Astra:进步明显但鲁棒性与可监控性存疑
Hot take on GPT-6 Astra
Gary Marcus 发文点评 GPT-6 Astra,称多项报告显示其为真正的进步,OpenAI 产品显式创建并操纵符号世界模型,令其近十年的主张获得印证。
作者结合自身近十年主张神经符号世界模型的立场,指出 Astra 的关键未知在鲁棒性与可监控性,判断有具体依据。
一个令人印象深刻的系统,能够在(某种未知程度上)构建符号世界模型
ARC Prize@arcprize 由 @OpenAI 打造的 GPT-6 Astra 在 ARC-AGI 上达到 SOTA:- Astra 在 ARC-AGI-3 上得分 63%,通过新的提供商适配器 harness 达到 99% - 它在 96% 的 ARC-AGI-3 关卡上超越了人类表现 - 它构建了我们所见过的对新颖环境最精确的符号模型 我们的分析:
下午7:39 · 2026年9月3日 · 29.3万次浏览 * * * 51条回复 · 194次转发 · 1.81K次点赞 关于 OpenAI GPT-6 Astra* 的热辣观点1,文末对 Greg Brockman 关于其达到 AGI 的说法提出了质疑:
看起来相当令人印象深刻。多份报告表明这是一项真正的进步。
作为一个近十年来一直为(神经)符号世界模型奔走呼吁、且常常遭到异常敌意对待的人,看到 OpenAI 的一款产品在其一些最令人印象深刻的计算过程中明确地创建和操作符号世界模型,极其令人感到扬眉吐气。
我们不知道的是这种能力有多稳健。这才是关键问题。
在 ARC-AGI 上取得成功固然了不起、令人印象深刻,但——尽管这项任务的名字如此——并不能证明 AGI;我怀疑我们会在开放式真实世界任务上看到大量问题。与其他近期模型一样,我猜测它在可验证领域表现最佳。
而作为一名科学家,令人失望的是,我们(还?)对该系统实际如何运作知之甚少。
如果对其内部机制没有更清晰的了解,我对它能做什么、不能做什么,以及我们可能遭遇哪些新风险,都感到不那么有信心。我怀疑这个世界还没有准备好。
一如既往,热情支持者获得了提前一窥的机会;怀疑者则没有。这是一种高明的营销策略,但往往最终被证明具有误导性。我们经常看到的是,最初的热情会随着时间推移而降温。我怀疑我们在这里也会看到同样的情况。
这个新系统似乎比之前的系统更不可监控,从安全角度来看这并不好。人们真的不希望能力更强却同时可监控性更低。但同时也更可对齐,不知道为什么。
如果能看看 Astra 能否在 Miles Brundage 和我在 2024 年底打赌的那十项任务中取得任何进展,那就太好了。(据我所知,迄今为止还没有任何 AI 在其中任何一项上成功过。)
这个热点观点非常初步,有待更多关于该系统如何运作的信息,以及对其局限性的更详细审视。
来源:Gary Marcus:The Road to AI We Can Trust(RSS) · garymarcus.substack.com
下午7:39 · 2026年9月3日 · 1.9万次浏览 * * * 2条回复 · 5次转发 · 153次点赞