Anthropic 认输了:下半年的 AI 王座归 OpenAI
8 月 25 日,AI 圈知名爆料人 leo(@synthwavedd)发了一条消息:OpenAI 完成了代号 Bel 的新一轮预训练,总参数超过 10 万亿,和 GPT-4.5 一个量级。Bel 是 Doug 的继任者,后面的 Astra、GPT-6 都会从它分叉出去再叠 RL。OpenAI 内部认为它可能是”够到 AGI 门槛”的底座。
同一条消息里还有另一半:OpenAI 认为 Anthropic 手上没有能公开发布的、接得住 Astra 的东西,而 Anthropic 自己也接受了这个判断——主要卡在算力上,准备把今年剩下的大部分时间让出去,赌明年年初重回巅峰。
拆开来看,有三个角度值得想。
一、两边都在等对方先出牌
OpenAI 8 月 1 日通过一篇数学论文官宣了 Astra 的名字——内部版本解决了十个长期未解的数学问题,涵盖群论、高维几何、格密码学等方向,每道题都附了 Lean 4 的机器验证证明。这是一个非常不寻常的亮相方式:不发产品,先发论文,用学术成果代替 benchmark 来立威。
但 Astra 至今没有发布。8 月 7 日 Axios 报道,OpenAI 披露 Astra 可能存在”关键级别”的网络安全能力,启动了额外安全测试,并在 8 月 18 日正式暂停了与 Astra 相关的强化学习训练。预测市场目前把发布时间压到了秋天。
另一边,多个独立来源指向同一件事:Anthropic 的 Claude Fable 5.1 已经准备好了,但在等 Astra 先出。两家都在避免先手暴露弱点——先发的那个会立刻被拿来跟对手的最强版本做对比。
这种僵局在消费品行业很常见,在 AI 领域是第一次看到。它说明一件事:模型之间的差距已经小到发布时机比模型本身更重要。
二、算力账本才是真正的战场
leo 的爆料里说 Anthropic 卡在算力上,这和公开信息对得上。
今年 3 月底,Anthropic 悄悄收紧了 Claude 的使用限额——工作日高峰时段(东部时间上午 8 点到下午 2 点)额度明显下降。4 月,GitHub 暂停了新的 Copilot 注册,理由是”不可持续的算力需求”。Opus 模型被从低阶订阅中移除。Dario Amodei 公开说过,公司处于”算力受限”状态。
但钱不是问题。同在 4 月,Google 宣布向 Anthropic 投资最高 400 亿美元(估值 3500 亿),其中包括 5 吉瓦算力承诺;Amazon 累计投资额也推到了 330 亿美元,承诺到年底提供近 1 吉瓦的 Trainium2/3 产能。两笔加起来,Anthropic 手上有约 650 亿美元的认缴资本和 10 吉瓦的预留算力。
问题在于:签了合同不等于芯片到位。GPU 订购、数据中心选址、供电配套,从签约到上线至少 18 到 24 个月。今天签的钱,变成可用算力要到 2027 年底甚至 2028 年。而 OpenAI 目前的算力约 4–6 吉瓦,2027 年预计到 10–12 吉瓦,部分通过 Stargate 合资企业自持。Google 更夸张,当前 15–20 吉瓦,2027 年 25 吉瓦以上,而且是全栈垂直整合——自研 TPU、自建数据中心、自有电力。
这就是 Anthropic 让出下半年的真实原因:不是模型不行,是芯片还没到。Fable 5.1 也许够打,但如果 Astra 背后有一个 10 万亿参数底座撑着,用同等规模的 RL 去叠,天花板不在一个层面。
三、预训练路线重新回到主线
过去两年的叙事重心一直在后训练:RL、推理、工具使用、agent。“预训练已经到头了”几乎成了行业共识——scaling law 触顶、数据耗尽,接下来全靠后训练出花样。
Bel 把这个叙事推翻了。先花一大笔算力堆一个足够大的预训练模型,然后所有后续产品(Astra、GPT-6、再往后的东西)都从底座分叉出去。RL 是叠加项,不是主线。
这其实是一笔很朴素的账:底座每抬高一点,上面所有分支一起受益。GPT-4.5 当初就是这个思路——先做一个巨大的密集模型,再从它衍生出不同定位的产品(Sol、Terra、Luna)。Bel 是同一条路线的下一步。
代价也很清楚:这笔投入必须一次性付清,而且付的时候还看不到回报。能不能付得起、愿不愿意付,取决于手上有多少芯片。又回到了算力。
代号会变,发布时间会推迟,这些细节都会动。但底下那个约束不动:这一轮谁能做什么,取决于谁手上有多少芯片、什么时候能用上。一家公司选择”这半年先不争了”,比任何 benchmark 都更能说明竞争在哪一层展开。