脑机网 脑机网LOGIC.WANG
ESC

DeepSeek把API价格打回地板,大模型的价格战谁先撑不住?

上周你公司里负责技术的小伙子可能悄悄发现,调一次大模型接口的钱,突然变便宜了。这不是错觉,是一场刚打响的降价潮。

2026-09-16 · 1040 字 · 脑机网

上周你公司里负责技术的小伙子可能悄悄发现,调一次大模型接口的钱,突然变便宜了。这不是错觉,是一场刚打响的降价潮。

9月10日,深度求索发布DeepSeek V4.1-Flash,采用552B参数的MoE新架构,主打高能力上限和更快推理。不到一周,9月15日披露的运营动作更狠:距离8月那轮提价才过去20多天,DeepSeek又启动了大降价,缓存命中输入单价低至每百万token 0.02元,价差最高拉到50倍。同一时间,公司砸下约110亿元布局基础设施,在内蒙古乌兰察布建设1GW超级数据中心,部署16万颗华为昇腾950DT芯片。

为什么先提价又降价

这步棋看着矛盾,逻辑其实很直白:先用提价测试开发者黏性,发现用户被友商分流,再降价把开发者抢回来。2026年前7个月,DeepSeek营收约4.75亿元,差不多是2025年全年的10倍,但仍亏损约7.15亿元——烧钱换规模,是国产大模型当下的共同剧本。

更关键的是,公司同期委托中信证券筹备科创板IPO,有望年内递表。降价既是抢生态入口,也是给资本市场讲"我能规模化"的故事。

对普通人意味着什么

当百万token的价格从"论美元"变成"论分",被压制的中小开发者、垂直行业应用和端侧场景会成批释放。以前做个AI小工具,光推理成本是门槛;现在门槛塌了,拼的就是谁更懂用户、谁的场景更准。

一个容易被忽略的信号:国产厂商主导的这轮下探,正在把"用得起AI"从口号变成基础设施。未来比的不是谁的模型参数多,而是谁能以更低成本、更稳时延,交付"够用的智能"。

如果你正打算用AI提效,三条建议:第一,中小团队和个人现在试水AI写作、做图、写代码,优先选按量计费的国产模型,成本已经低到可以忽略;第二,别被"免费"噱头带偏,重点看长期稳定性和响应速度;第三,把省下的算力预算,花在打磨你自己的内容和工作流上。

值得一提的是,这轮降价正撞上国产大模型集体冲击IPO的节点。智谱9月13日刚完成约50亿美元融资,阶跃、MiniMax等也在密集补血。当训练成本靠融资续命、推理价格却一路下探,"用亏损换规模"能撑多久,是悬在每家中国大模型公司头上的问号。

从用户视角看,这场价格战最大的受益者不是某家公司,而是所有想用AI的人。当调用成本趋近于零,"试错"本身就变便宜了——个体开发者可以大胆把AI接进自己的小生意,小店老板能用它写文案、做客服。工具民主化的拐点,往往就藏在这样一次次降价里。

当百万token从论美元变成论分,被压制的普通创作者,才会真正成批冒出来。

查看「AI大模型」更多内容 → · 返回首页