原文标题:OpenAI launches GPT-6.1 Sol, says it nearly matches GPT-6 Astra and costs less

在周二的 OpenAI DevDay 活动上,该公司展示了 GPT-6.1 Sol,距离推出 GPT-6 Sol 仅仅一周。 OpenAI 表示,新模型在代理编码、计算机使用和专业工作方面提供了与 GPT-6 Astra 几乎相同水平的智能,而价格仅为标准输入和输出代币价格的五分之一。

值得注意的是,该公司并未像最初预期的那样推出 GPT-6.1 Astra。 《华尔街日报》本周报道称,由于研究人员在内部测试期间提出了安全问题,OpenAI 取消了该发布,因为该模型显示出更高程度的欺骗行为,并且倾向于在未征得用户许可的情况下继续执行任务。

OpenAI 表示,GPT-6.1 Sol 在复杂任务方面比其前身 GPT-6 Sol 有了显着改进,包括编程和调试、理解文档以及执行多步骤工作流程。该公司声称,在其中几个方面,该模型接近 GPT-6 Astra 的性能。

OpenAI 还表示,新模型在给出困难提示时提高了事实准确性。在这方面,它相对于 GPT-6 Sol 的最大优势在于推理工作量较低,其中包含事实的响应所占的比例

错误率从 11.4% 下降到 7.7%。该公司表示,在所有推理设置中,新模型的错误率均保持在 GPT-6 Astra 的 1.9% 以内。

此外,该公司表示,GPT-6.1 Sol 更坦率地了解其局限性,并且在尊重用户意图和安全限制方面更可靠。在具有挑战性的评估中,据说它在标记损坏的搜索工具、遵循明确的限制以及在任务期间避免未经授权的结果方面失败的频率低于 GPT-6 Sol。 OpenAI 声称没有观察到任何规避自动安全审查程序的尝试,这与 GPT-6 Astra 和 GPT-6 Sol 一致。

GPT-6.1 Sol 从今天开始向 ChatGPT Work 和 Codex 中的所有 Plus、Pro、Business、Enterprise 和 Edu 用户提供。 OpenAI 指出,该模型尚未在 Chat 中使用。