一周前,GPT-6 Astra 正在游戏引擎中逐条街道重建曼哈顿,其功能让左右用户惊叹不已。本周,同一群人发布了屏幕截图,询问 OpenAI 他们的模型发生了什么。

“今天对我来说,Astra 感觉自己更加愚蠢了”,流行的化名开发者 Synthwavedd 在 X 上发帖说。 “发射后脑白质切除术只是时间问题。真遗憾。”

这是一种熟悉的说法,习惯了他们最喜欢的聊天机器人和代理的人工智能用户突然感觉自己被“削弱了”。大多数时候,这些模型的性能下降都有合理的解释。但当足够多的人开始同时说同样的话时,就值得检查一下到底发生了什么。目前社交媒体上充斥着用户迅速对 GPT-6 Astra 产生兴趣的例子。

开发人员 Pranjal Paliwal 之前曾赞扬过该模型,现在他回去实际阅读了 Astra 为他编写的代码。他不喜欢他所发现的东西。

“我们没有通用人工智能,”他发帖说。 “我们出现了倒退。”

fml,终于看了一下astra写的代码。我收回我的话。

我们没有通用人工智能。我们有一个回归。

它怎么能同时如此聪明又如此愚蠢!

- Pranjal Paliwal (@betterclever) 2026 年 9 月 11 日

AGI 是通用人工智能的缩写,是业界的术语,指的是一种机器,它基本上可以完成人类认知上可以做的任何事情。 OpenAI 的总裁在 Astra 的发布会上使用了这个词。一周后,他的一位用户用它来描述相反的情况。

这些投诉具有相似的形状。开发人员 Pankaj Kumar 列出了这些症状:答案更快、质量更差,以及怀疑 OpenAI“降低了果汁价值”。创始人 Saba 直接询问 OpenAI 为什么她现在必须“简化”才能完成任务。

“果汁价值”不是一个官方术语。没有人定义它。但这是这里每个人都明白的简写:模型在给出答案之前花费的计算量,以及 OpenAI 在发布演示完成工作后悄悄调低的怀疑。

有人测试了一下,确实正确。 Salio 和研究员 Md Ismail Sojal 都对发布日的 Astra 和今天的版本运行了相同的提示,但都得到了比当前版本更糟糕的结果。

今天的 GPT-6 Astra 输出看起来更糟。发布时的 GPT-6 Astra 与今天的 GPT-6 Astra。

- Tibo 说他们有计算 - 相同的提示,相同的设置。 - evan 我在 GPT-6 Astra 发布时和今天再次运行了完全相同的提示。 - 差异比我想象的要大。

— Md Ismail Šojal 🕷️ (@0x0SojalSec) 2026 年 9 月 11 日

其他人只是切换回来。编码工具 Opencode 的开发者 Dax Raad 表示,他的团队已经回到了 Astra 的前身 GPT-5.6 Sol,因为不值得的缺点导致支出翻倍。 ChatGPT 用户 Mustafa Sahinli 说得更直白:Astra 现在让他感觉像是“发布 1 周后”的 Claude Opus 4.6,这是对 Anthropic 自己发布后强烈反对的一记猛击。

不过,并不是所有人都认为 OpenAI 故意削弱了其最新模型。匿名用户 Antikythera 发表了最详细的反驳,认为时间线倒退。

“它和发射时一样愚蠢,”安提凯西拉写道。 “这个模型很好,但是这个模型有很多问题。它很懒。写起来就像一个对要点上瘾的人......人们在发布周被过度炒作,现在他们有时间测试它并看到它的错误。”

换句话说:什么都没有改变。当你不再眼花缭乱时,你会注意到这个模型总是有点对要点上瘾。

T3Chat 创始人 Theo 也有类似的想法:Astra 实际上比 Claude Fable 更加不一致,因此它有时会产生出色或彻头彻尾愚蠢的代码。蜜月期结束后,似乎正在发生一波用户更频繁地发布愚蠢结果的浪潮。

GPT-6 Astra 完成了我从未想过模型能做到的令人难以置信的事情。它还做了一些我见过的模型中最愚蠢的事情。

总的来说,《神鬼寓言5.1》就满足了我的要求。 pic.twitter.com/X2UwI7tDnD

— Theo - t3.gg (@theo) 2026 年 9 月 8 日

这也不是什么新鲜事。 OpenAI 的最后一款旗舰产品 GPT-5.6 Sol 在 7 月份经历了相同的周期,当时用户报告其顶级推理模式一夜之间变得浅薄。 OpenAI 高管 Tibo Sottiaux 否认故意削弱它,同时确认该公司一直在尝试推理工作,即控制模型在回答之前“思考”多少步骤的设置。

一个回复总结了这个流传已久的笑话:封闭的实验室发布了一个模型,它“几天后患上了某种疾病,然后突然变得更笨了”。另一位人士用一句话概括了这位愤世嫉俗者的理论:“他们可能会被量化,这样他们就不会烧公司那么多钱。”

但这一次他们到达时很愚蠢。我给了 Astra 一项任务,它惨败了,xHigh 上的 5.6 SOL,然后进行了清理......

— 物理学家 🏖️ 💻 (@heisenberg_btc) 2026 年 9 月 11 日

量化模型意味着缩小其内部数学的精度以降低成本,通常会以牺牲准确性为代价。 OpenAI 从未证实故意对已发布的模型这样做。

OpenAI 尚未发布有关 Astra 的 Sol 式声明。该模型仍然是该公司第一个跨越所谓的网络安全风险关键阈值的模型,这意味着它可以在没有人工指导的情况下找到未知的软件漏洞并将其链接在一起,而根据 OpenAI 的 Daybreak 计划,这种能力仅限于经过审查的防御者。

不管是否愚蠢,它仍然需要每百万个输入代币 10 美元,每百万个输出代币 50 美元,是 Sol 发布时收费的 2.5 倍。