Google DeepMind 已将其下一代模型 Gemini 4 过渡到早期的训练后阶段。 Koray Kavukcuoglu 于 2026 年 8 月 12 日晋升为 Google DeepMind 高级副总裁,他在 2026 年 9 月 23 日至 24 日举行的信息 AI 议程实时峰会上首次公开露面时确认了这一里程碑。对于一家公司来说,这标志着一个关键的转变,该公司当前的前沿产品在标准情报基准上落后于市场领导者 40%。

卡武克措格鲁(Kavukcuoglu)发出了一个积极的时间表。 “我们的目的是尽快推出早期的培训后版本,因为我们已经看到了有希望的结果并且非常兴奋,”他说。没有提供具体的发布日期,但目标比今年年底要早得多。步伐引人注目:谷歌宣布于 2026 年 7 月 21 日开始最雄心勃勃的 Gemini 4 预训练。从预训练到训练后的过渡需要大约两个月的时间,时间很短,特别是考虑到 Gemini 3.5 Pro 自 2026 年 6 月以来一直停留在合作伙伴测试阶段。

能力差距

紧迫性从数字中可见一斑。在智能指数 v4.3.2 上,Google 目前的前沿型号 Gemini 3.6 Flash 得分为 34.0。这落后于 Anthropic 的 Opus 5.5(57.6)、GPT-6 Astra(52.7)和 OpenAI 的 GPT-6 Sol(47.5)。 Gemini 3.6 Flash 和 Opus 5.5 之间 24 分的差距并不是边际差距,而是前沿竞争和低于前沿竞争之间的差异。 Gemini 4 是 Google 缩小这一距离的尝试。

一周,四个实验室,零约束

卡武克措格鲁宣布这一消息的时机就是故事。 9 月 21 日至 9 月 22 日期间,市场以 2 美元/6 美元的价格吸收了 Grok 4.7,以 4 美元/20 美元的价格吸收了 Opus 5.5,并以永久降价 50% 的价格吸收了 GPT-6 Sol 和 Luna。 Amodei 节奏框架所维持的协调定价结构在不到两天内就崩溃了。谷歌在这波浪潮之后立即确认了 Gemini 4 的训练后状态,表明它打算参加下一个周期的竞争,而不是袖手旁观。

但谷歌尚未披露的细节并不像它所掌握的那样重要。没有架构。无参数计数。没有定价。没有基准。众所周知,该模型的重点是:编码、自主代理和长期代理工作流程——这些功能超越了文本生成,进入了主动任务执行。谷歌表示,Gemini 4 比之前的型号“大得多”。问题是,在目前定义市场的基准上,更大的规模是否意味着具有竞争力。

评估张力

更广泛的背景使赌注变得更加尖锐。本周,业界争论由谁来定义安全评估——从实验室首席执行官在联合国安理会简报会上就他们自己的模型的风险作证,到 OpenAI 发布自己的评估框架。推动更快的交付与更严格的评估的需求相矛盾。谷歌正在压缩上市时间,与此同时,业界正在询问培训后评估是否足够彻底,以发现本季度的失败——从澳大利亚医疗保险违规事件到拥抱脸事件。

对于评估模型路由策略的构建者来说,Gemini 4 的到来(无论何时到来)都会为已经不稳定的堆栈决策引入一个新变量。当前的价格战意味着每任务成本是新的战场。如果 Gemini 4 以具有竞争力的价格进入前沿级性能,它可能会重新分配开发者生态系统。如果低于标准,谷歌在人工智能代理经济中的地位将进一步削弱。

投资者应该关注两个信号:领导层的重组是否会导致 Kavukcuoglu 超越 Gemini 开发而转化为执行速度,以及压缩的培训后时间是否会产生一个达到或未达到市场现在预期的能力门槛的模型。自 GPT-4 时代以来,三路边境竞赛从未如此压缩过。谷歌选择加速而不是等待。这种选择是否会产生有竞争力的产品或不成熟的产品是下一季度的决定性不确定性。