Tomer Tunguz 博客(VC 分析) · 2026/9/23

AI 价格崩塌:竞争不在前沿,而在肥厚的中间层

Anthropic 与 OpenAI 接连发布新模型并降价:OpenAI 将 Luna 再降 50%,Anthropic 首次下调 Opus 价格;开源模型以 86% 的折扣承担多数 token 用量;最强模型 Fable 5.1 头十二天仅占网关支出 3.7%,企业客户前沿模型 token 占比从 53% 降至 45%。作者认为需求是“肥中间”的正态分布,竞争集中在中间层。

简而言之:AI 价格正在崩塌,但竞争并不发生在前沿。Anthropic 在五次发布中把 Opus 系列的价格维持在 5 美元和 25 美元,而 OpenAI 将 Luna 降价 80%,昨天又降了 50%;开源模型如今承担着大部分 token 用量,价格比闭源模型低 86%。能力最强的模型 Fable 5.1 在发布后的头十二天里只占网关支出的 3.7%。需求是一条正态分布曲线,中间部分很厚;随着每美元智能的爆炸式增长,token 可能会转向大宗商品化。这件事是否发生,将决定 AI 市场的经济格局。

昨天,Anthropic 发布了一款新模型并下调价格。九十分钟后,OpenAI 也做了同样的事。大多数商业 AI 用途都处在混乱的中间地带:多步骤工作流需要一个足够聪明的模型,而且价格要在企业负担得起的范围内。这是当今市场最重要的部分,也是竞争最激烈的地方。降价就是证据。

六月,Anthropic 用 Fable 5 把前沿价格定在每百万 token 10 美元和 50 美元。七月,OpenAI 用 GPT-5.6 Sol 以 5 美元和 30 美元回应,在同等能力下把每项任务的成本压到三分之一。Opus 系列此前从未变动过。Opus 4.5、4、4.8 和 5 的标价都是每百万 token 5 美元和 25 美元。昨天的降价是第一次。

低端的情况更加极端。OpenAI 在七月将 Luna 降价 80%,昨天又降了 50%。不只是闭源阵营的相互竞争,开源模型同样在压低价格。AI 货架上的“通用款”在公布数据的网关上承担了大部分 token 用量,价格比闭源模型的混合价格低 86%。大客户通过微调追求更大的节省。Cursor 的 Composer 2 对开放权重的基座 Kimi K2.5 做了微调,把整体成本相对其此前的自研模型削减了 86%。Harvey 也这么做,把单位单元格成本相对 Sonnet 5 降低了 55%,同时得分还高于 Fable 5。

但市场的右尾比几乎所有人预测的都要薄。Anthropic 能力最强、价格也最高的模型 Fable 5.1,在头十二天里只占网关支出的 3.7%。它的前代在七月恢复访问时峰值达到 13.2%,一个月后 Opus 5 以半价发布时降到了 4.9%。在大型企业客户中,前沿模型占 token 消耗的比例从八月初的 53% 降到九月的 45%。

对智能的需求不是一座金字塔——顶端一小撮有钱人支付下面所有人的费用。它是一条正态分布曲线,中间很厚。中间部分购买的是每美元能买到多少智能。智能的成本持续暴跌。企业对 AI 的需求变化却没有这么快。所以,满足某个固定需求的那一档会不断变便宜。当每美元智能爆炸式增长时,token 的分布可能会转向大宗商品化。这件事是否发生,将决定 AI 市场的经济格局。

FDE 判断

对企业 AI 交付而言,价值重心落在“足够聪明且负担得起”的中间层;FDE 需把模型选型、微调与开源权重方案、单位任务成本纳入方案设计,而非默认使用前沿模型。企业客户前沿模型 token 占比下降,表明客户更看重性价比与可落地的多步骤工作流,成本优化与选型能力将成为 FDE 求职与交付中的加分项。