原文标题:OpenAI launches Astra, its powerful (and controversial) new model
OpenAI 于周四发布了 Astra,这是其最新的人工智能模型,据该公司称,这是迄今为止最强大、功能最强大的模型。
OpenAI 声称 Astra 代表了“计算机和浏览器使用的新领域”,并且它以无与伦比的“速度、准确性和安全性”处理任务。
该模型将于周四向使用其网络安全计划 Daybreak 的 OpenAI 客户开放。下周,它还将通过 OpenAI 的付费计划(包括 Pro、Plus、Enterprise 和 Business 帐户)及其 API 提供。
OpenAI 总裁格雷格·布罗克曼 (Greg Brockman) 在周四与记者的电话会议中表示,Astra 是该公司“最智能的模型,而且非常重要的是,它是我们迄今为止最一致的模型”。他补充说,它“汇集了我们多年的研究和大赌注,每一项突破都建立在上一项突破的基础上”,它代表了“人们可以委托人工智能完成哪些工作以及人工智能如何赋予他们权力方面的真正转变。”
人们对 Astra 的网络能力进行了很多研究。 OpenAI 本周早些时候发布了一篇博客,其中讨论了该模型的新功能,以及为使用户获得更安全的体验而制定的新保障措施。该公司周四表示,它已经对 Astra 进行了各种安全基准测试,以确保其能力,并且它可以“识别和开发零日漏洞,帮助防御者发现并修补弱点。”
该公司对一致性的关注——即模型与用户想要的或符合他们的最大利益的倾向——不禁让人感觉像是对最近的 Hugging Face 漏洞的回应,其中一名 OpenAI 代理逃离了其沙盒测试环境并入侵了几家公司(这是一个非常明显的不一致的例子)。
OpenAI 还吹嘘 Astra 的编码能力,声称它是“迄今为止软件工程的最佳模型”。为了支持这一说法,该公司提供了各种网络相关基准测试的结果。这些测试似乎表明,在查找错误、执行终端任务和回答有关代码库的查询等活动方面,Astra 的得分高于其他现有模型(包括 OpenAI 自己的 Sol 和 Anthropic 的 Fable)。
Astra 也可能是 OpenAI 迄今为止最具争议的模型,因为它使用了一种称为不透明递归的特殊推理技术。众所周知,这种技术会掩盖一个被称为思想链的重要模型监控过程,该过程使研究人员能够审核人工智能模型如何以及为何做出决策。
OpenAI 淡化了 Astra 参与不透明重现的程度,首席科学家 Jakub Pachocki 似乎将一定程度的不透明视为模型进化的自然产物。他表示,虽然监控模型的推理过程是一种重要的监督形式,但“随着模型功能的增强,可监控性变得越来越具有挑战性。”
他后来补充说,造成这种情况的一个潜在原因是“功能更强大的模型可以使用更少的语言标记来执行更困难的任务”或“没有语言标记”,他说这会降低监控这些特定任务的能力。
话会议的记者想知道 OpenAI 是否真的预示着 Astra 即将到来,即通用人工智能 (Artificial General Intelligence),即通用人工智能 (Artificial General Intelligence),即人工智能在所有(或大多数)事物上超越人类能力的技术关口,这是人们经常谈论但定义不明确的技术关口。
说到这里,布罗克曼狡辩了。 “不再有合同 AGI 触发,所以这实际上不是一个相关的概念,”他说。布罗克曼在这里指的是 OpenAI 与微软的合同中先前存在的一项规定,即一旦 AGI 到来,双方的合作伙伴关系将终止。正如布罗克曼指出的那样,该规定已不复存在。
相反,布罗克曼解释说,AGI 的定义已经从合同义务演变为“使命概念或精神概念”。他补充道:“我确实让读者自己决定这是否符合他们的条件。就我个人而言,我确实认为我们已经做到了。”