脑机网 脑机网LOGIC.WANG
ESC

三十多个月的纪录被打破,开发者的钱开始往哪流?

第三方模型路由平台 OpenRouter 公布了一组数据:上周,OpenAI 模型的付费调用消耗量首次超过 Anthropic,终结了后者长达三十多个月的市场领先。

2026-09-17 · 949 字 · 脑机网

第三方模型路由平台 OpenRouter 公布了一组数据:上周,OpenAI 模型的付费调用消耗量首次超过 Anthropic,终结了后者长达三十多个月的市场领先。

关键词是"付费消耗量"——按花掉的钱算,不是按 token 数算。

两个指标说的是两件事

OpenAI 总裁 Greg Brockman 转发了这组数据。数据里还有一组对照更有意思:

  • 支出(钱包份额)算,Astra 是上周支出最高的模型
  • token 使用量算,Luna 遥遥领先

一个模型最花钱,另一个模型用得多。这说明企业的用法已经分层:把贵的模型留给真正复杂的任务,把便宜的模型拿去跑量大管饱的活。

逆转是怎么发生的

驱动这次份额变化的,是产品矩阵而不是单一模型的胜负。GPT-6 Astra、GPT-5.6 系列协同,企业客户可以按任务复杂度,灵活配置"高端推理 + 高性价比调用"的双轨方案。

这背后是一个行业性的转变:竞争焦点从"谁的模型更强",转向"单位算力成本能干多少活"

配合另一个动作看更清楚:OpenAI 已宣布 GPT-5.5 系列将于10月14日全平台下线。半年前的主力机型退役,为新一代腾位置。模型的"货架期"正在变短。

对开发者来说,这个信号很直接:多模型混用不再是大公司的专利。当单个模型的领先期只有几个月,"换模型"就成了一项常规运维工作,而不是一次架构决策。

这对行业意味着什么

1. 单一模型的领先期在缩短。三十多个月的纪录被打破,说明份额可以在一个季度内翻转,护城河比想象中浅。

2. 推理成本成了核心指标。企业采购时比的是编码补全、Agent 工作流这些具体场景的综合性价比,不是榜单分数。

3. 路由层变成了战场。像 OpenRouter 这样的中间层,掌握着"哪个模型被调用"的真实流量,它的数据比任何公关稿都诚实。

顺带看看A股的另一面

同一天,A股半导体板块集体爆发,科创50指数收涨4.14%。但要注意,这轮上涨和"谁的模型份额高"没有直接关系,它更多是国产算力产业链的景气兑现。

应用端的钱在往哪流、硬件端的钱在往哪流,是两条独立的线。把它们混在一起看,很容易得出错误结论。

算力贵、模型多、货架期短,这三件事叠在一起,决定了下一年行业胜负手不在发布会,在财报里的推理成本。

(风险提示:本文基于公开数据与媒体报道整理,不构成任何投资建议。市场有风险,决策需谨慎。)

查看「AI大模型」更多内容 → · 返回首页