简而言之:AI 价格正在崩塌,但竞争并不发生在前沿。Anthropic 在五次发布中把 Opus 系列的价格维持在 5 美元和 25 美元,而 OpenAI 将 Luna 降价 80%,昨天又降了 50%;开源模型如今承担着大部分 token 用量,价格比闭源模型低 86%。能力最强的模型 Fable 5.1 在发布后的头十二天里只占网关支出的 3.7%。需求是一条正态分布曲线,中间部分很厚;随着每美元智能的爆炸式增长,token 可能会转向大宗商品化。这件事是否发生,将决定 AI 市场的经济格局。
昨天,Anthropic 发布了一款新模型并下调价格。九十分钟后,OpenAI 也做了同样的事。大多数商业 AI 用途都处在混乱的中间地带:多步骤工作流需要一个足够聪明的模型,而且价格要在企业负担得起的范围内。这是当今市场最重要的部分,也是竞争最激烈的地方。降价就是证据。
六月,Anthropic 用 Fable 5 把前沿价格定在每百万 token 10 美元和 50 美元。七月,OpenAI 用 GPT-5.6 Sol 以 5 美元和 30 美元回应,在同等能力下把每项任务的成本压到三分之一。Opus 系列此前从未变动过。Opus 4.5、4、4.8 和 5 的标价都是每百万 token 5 美元和 25 美元。昨天的降价是第一次。
低端的情况更加极端。OpenAI 在七月将 Luna 降价 80%,昨天又降了 50%。不只是闭源阵营的相互竞争,开源模型同样在压低价格。AI 货架上的“通用款”在公布数据的网关上承担了大部分 token 用量,价格比闭源模型的混合价格低 86%。大客户通过微调追求更大的节省。Cursor 的 Composer 2 对开放权重的基座 Kimi K2.5 做了微调,把整体成本相对其此前的自研模型削减了 86%。Harvey 也这么做,把单位单元格成本相对 Sonnet 5 降低了 55%,同时得分还高于 Fable 5。
但市场的右尾比几乎所有人预测的都要薄。Anthropic 能力最强、价格也最高的模型 Fable 5.1,在头十二天里只占网关支出的 3.7%。它的前代在七月恢复访问时峰值达到 13.2%,一个月后 Opus 5 以半价发布时降到了 4.9%。在大型企业客户中,前沿模型占 token 消耗的比例从八月初的 53% 降到九月的 45%。
对智能的需求不是一座金字塔——顶端一小撮有钱人支付下面所有人的费用。它是一条正态分布曲线,中间很厚。中间部分购买的是每美元能买到多少智能。智能的成本持续暴跌。企业对 AI 的需求变化却没有这么快。所以,满足某个固定需求的那一档会不断变便宜。当每美元智能爆炸式增长时,token 的分布可能会转向大宗商品化。这件事是否发生,将决定 AI 市场的经济格局。