定价三角闭合

谷歌 DeepMind 选择了 9 月的最后一天来做一些事情,让前沿人工智能的竞争格局看起来几乎是数学化的。 9 月 30 日,高级副总裁 Koray Kavukcuoglu 宣布 Gemini 4 Argon 的首发定价为每百万输入代币 2 美元,每百万输出代币 10 美元,缓存输入可享受 95% 的折扣。二十四小时前,OpenAI 以完全相同的速率推出了 GPT-6.1 Sol。

这场比赛并非巧合。是到达前沿型号层的商品层。为了实现这一目标,OpenAI 将 GPT-6 Astra 的定价降低了一半。谷歌首次凭借能够在基准测试中领先的模型参加竞争,选择满足该价格,而不是低于或超过该价格。入门价格最终将翻倍,达到 4 美元/20 美元——但就目前而言,信号很明确:美国最大的两个实验室已经在近前沿情报方面趋于相同的经济学。

Anthropic 的 S-1 招股说明书于两天前提交,其中包含 5180 亿美元的计算承诺,使对比更加鲜明。 Anthropic 尚未推出 2 美元/10 美元的竞争对手。其战略仍然以企业为主导,以 Claude Code 为基础,季度收入达到 116 亿美元,现已超过 OpenAI。定价三角——OpenAI 2 美元/10 美元、Google 2 美元/10 美元、Anthropic 仅限企业——代表了商业模式的真正分歧,而不仅仅是营销方面的差异。

重要的基准

谷歌将 Argon 定位为新的前沿领导者,其领先数字是 DeepSWE v1.1:77.9%。如果接受独立审查,该分数将超越 Claude Opus 5.5(74.2%)和 GPT-6 Astra(74.1%)。 DeepSWE 衡量现实世界的长期软件工程任务——不是综合基准,而是企业买家实际需要的那种多步骤编码工作。

这个警告很重要。这些是供应商报告的数字。谷歌尚未发布独立验证,行业自我报告基准的记录也参差不齐。可验证的是该模型的技术规格:200 万个代币上下文窗口和 100 万个输出代币限制,高于之前 Gemini 模型的 64,000 个。该输出上限处于行业领先地位,专为企业工作流程所需的持续、复杂的推理而设计。

谷歌报告称,Argon 的内部使用已经使量子算法优化提高了 40%,在其数据中心释放了超过 300 TiB 的内存,并正在推动大规模代码库迁移到 Rust,其中包括对 Fuchsia Zircon 内核的 800,000 行重写。在 Vals 指数(以 GDP 贡献加权衡量金融、编码、法律和税务工作的经济影响)中,Argon 排名第一。在评估漏洞修复的 CWE-bench v1 上,它以 68% 的成绩并列第一。

费尔温德讽刺

Argon 的发行策略是故事在结构上变得有趣的地方。 Google 已将其 Fairwind 计划背后的模型封闭起来,为超过 650 个值得信赖的网络防御者提供访问权限,其中包括政府机构、医疗保健、电信、能源和金融领域的关键基础设施运营商,以及包括 CrowdStrike、Palo Alto Networks 和 Wiz 在内的安全供应商。仅用于防御。没有攻击性或双重用途授权。 Wiz 已经通过其 Scan for Good 计划使用 Argon 来查找全球医院使用的医疗保健软件中的漏洞。

这与人择形成了鲜明的对比。 9 月 25 日,华盛顿特区巡回法院根据 FASCSSA 第 4713 条将 Anthropic 列为供应链风险,将该公司的安全限制转变为国家安全责任。这项裁决实际上将 Anthropic 拒绝允许其模型用于自主武器或国内大规模监控的行为重新归类为对国家安全的威胁——谷歌现在通过 Fairwind 将这些限制定位为竞争优势。

谷歌正在将前沿网络能力运送到同一个国防生态系统中,而 Anthropic 目前在法律上无法提供服务。限制自己的公司正在因此受到惩罚;为可信赖的防御者提供访问权限的公司正在获得奖励。这种动态是否成立取决于联邦贸易委员会在氩气发射当天宣布的调查如何评估所有前沿实验室的安全声明。

四个实验室,一个价格点

Argon 的发布结束了一个月,美国所有四个主要前沿实验室都以 2 美元/10 美元的价格或接近的价格部署了自主代理或下一代模型。 OpenAI 于 9 月 29 日推出了 Dots 和每月 500 美元的 Pro 500 套餐。Meta 的 Muse 自 9 月 8 日以来一直处于消费者测试阶段。SpaceXAI 的 GrokBot 于 8 月 11 日发货。苹果的 Siri AI 于 9 月 14 日推出,仅供个人使用,没有企业管理。

谷歌推出的 Argon 在一个结构性方面与其他公司不同:它是第一个与 OpenAI 的定价完全匹配的产品,同时又声称处于基准领先地位。 OpenAI 将自己的利润压缩至 2 美元/10 美元;谷歌在第一天就得出了同样的数字。问题是,这种趋同是否反映了对数量和平台经济的共同押注,或者只是认识到,在中国实验室的开放权重模型约占 OpenRouter 顶级模型代币流量的 61% 的市场中,任何更高的价格点都站不住脚,平均每百万代币 0.83 美元——比专有替代方案便宜 7.3 倍。

尚待解决的问题

三个不确定性决定了下一阶段。首先是基准差距:Argon 的 DeepSWE 77.9% 领先前沿,但没有独立实验室验证过这个数字。在基准领先地位声明可以被视为结构性而非营销之前,该行业需要第三方评估。其次,定价下限:谷歌和 OpenAI 都计划将其推出价格提高一倍。当开放重量替代品的成本仅为一小部分时,市场是否会接受 4 美元/20 美元仍然是一个悬而未决的问题。第三,监管环境:联邦贸易委员会的调查和华盛顿特区巡回法院的裁决给每个前沿实验室带来了不确定性,但不对称是真实存在的。 Anthropic 面临供应链风险分类,而 Google 将前沿网络运送给同样的国防客户 Anthropic 则被限制提供服务。

定价三角形已闭合。基准竞赛是谷歌要捍卫的。监管棋盘仍在搭建中。

注意:引用的所有基准数据均由供应商报告,未经独立验证。 Gemini 4 Argon 的推介价格(2 美元/10 美元)在推介期结束后将上涨至 4 美元/20 美元。 Fairwind 计划于 2026 年 9 月 2 日针对 Gemini 3.8 Flash Cyber​​ 推出;氩气接入已于 9 月 30 日推出。据路透社报道,Anthropic S-1 数据来自招股说明书——该文件尚未出现在 SEC EDGAR 上。联邦贸易委员会的一名高级官员向路透社证实了联邦贸易委员会的调查。