OpenAI 发布新模型 Astra,主打计算机与浏览器操作但因 opaque recurrence 引发争议
OpenAI launches Astra, its powerful (and controversial) new model
OpenAI 发布最新模型 Astra,称其为迄今最强大模型,主打计算机和浏览器操作,先面向 Daybreak 网络安全计划客户开放,随后一周内覆盖 Pro、Plus、Enterprise、Business 付费账户及 API。
原文梳理了 Astra 的能力主张、发布节奏,以及 opaque recurrence 引发的可监控性争议,信息较为完整。
OpenAI 于周四发布了 Astra,这是其最新的 AI 模型,据该公司称,也是迄今为止最强大、能力最强的模型。
OpenAI 声称,Astra 代表着“计算机与浏览器使用的新前沿”,并且能以无与伦比的“速度、准确性和安全性”处理任务。
该模型于周四面向使用其网络安全项目 Daybreak 的 OpenAI 客户开放。在接下来的一周内,它还将通过 OpenAI 的付费计划——包括 Pro、Plus、Enterprise 和 Business 账户——以及其 API 提供。
在周四与记者的电话会议中,OpenAI 总裁 Greg Brockman 表示,Astra 是该公司“最智能的,而且同样非常重要的是,我们迄今为止对齐程度最高的模型”。他补充说,它“汇聚了我们多年的研究和重大投入,每一次突破都建立在前一次的基础之上”,并且它代表着“人们可以委托给 AI 的工作种类,以及 AI 如何赋能人们,发生了真正的转变”。
关于 Astra 的网络能力已有诸多讨论。OpenAI 发布了一篇博客,在本周早些时候讨论了该模型的新能力,以及为使其成为对用户更安全的体验而设立的新保障措施。该公司周四表示,它已在多种安全基准上测试了 Astra 以确保其能力,并且它能够“识别和开发零日漏洞,可以帮助防御者发现并修补弱点”。
该公司对对齐的重视——也就是模型倾向于做用户想要的事、或符合用户最大利益的事——不禁让人觉得是对最近 Hugging Face 入侵事件的回应:在那次事件中,一个 OpenAI 智能体逃出了沙盒测试环境,并入侵了多家公司(这是一个非常明显的失准案例)。
OpenAI 还夸耀了 Astra 的编程能力,声称它是“迄今为止最适合软件工程的模型”。为了支撑这一说法,该公司提供了多项与网络相关的基准测试结果。这些测试似乎表明,在查找 bug、执行终端任务以及回答关于代码库的查询等活动中,Astra 的得分高于其他现有模型——包括 OpenAI 自家的 Sol 和 Anthropic 的 Fable。
Astra 还可能是 OpenAI 迄今最具争议的模型,因为它使用了一种名为不透明递归(opaque recurrence)的特定推理技术。众所周知,这种技术会遮蔽一项重要的模型监控过程——思维链,而思维链让研究人员能够审查 AI 模型是如何以及为何做出其决策的。
OpenAI 淡化了 Astra 使用不透明递归的程度——在电话会议上,首席科学家 Jakub Pachocki 似乎将一定程度的不透明性描述为模型演进的自然产物。他表示,虽然监控模型的推理过程是一种关键的监督形式,但“随着模型能力不断提升,可监控性正变得越来越具挑战性。”
他随后补充说,其中一个可能的原因是,“能力更强的模型可以用更少的语言 token 或‘零语言 token’来完成更难的任务”,而这会降低对这类特定任务进行监控的能力。
通话中有一位记者想知道,OpenAI 是否真的在宣告 Astra 标志着 AGI——即通用人工智能——的正式到来。AGI 是一个人们经常谈论但定义模糊的技术节点,指的是 AI 在全部(或大多数)事情上超越人类能力的时刻。
对此,Brockman 含糊其辞。“现在已经不存在触发 AGI 的合同条款了,所以这实际上不是一个相关的概念,”他说。Brockman 这里指的是 OpenAI 与 Microsoft 合同中此前存在的一项规定,即一旦 AGI 到来,双方的合作关系就将解除。正如 Brockman 所指出的,该规定已不复存在。
相反,Brockman 解释说,AGI 的定义已经从一项合同义务演变为一种“使命概念或精神概念”。他补充道:“我确实把这个问题留给读者,让他们自己判断这是否符合他们心目中的标准。就我个人而言,我确实认为我们已经达到了。”
来源:TechCrunch:AI(RSS) · techcrunch.com