---
title: "大模型又便宜了四成，为什么你的账单没降？"
date: 2026-09-27
category: AI大模型
site: 脑机网
canonical: https://www.logic.wang/a/njw-6cb570
language: zh-CN
---

# 大模型又便宜了四成，为什么你的账单没降？

> 你有没有发现一件怪事：新闻里天天说大模型降价，可你自己掏的钱、公司报的账，好像一点没少。

你有没有发现一件怪事：新闻里天天说大模型降价，可你自己掏的钱、公司报的账，好像一点没少。

上周又来了两轮。一边是 Anthropic 发布 Claude Opus 5.5，一边是 OpenAI 同步下调 GPT-6 系列的价格。两家隔着一天动手，像约好了一样。

## 这次降的到底是什么
Anthropic 的官方博客写得很直白：Opus 5.5 的输入价格是每百万 token 4 美元，输出是 20 美元，两项都比上一代 Opus 5 低两成；缓存读取从 0.5 美元砍到 0.2 美元，降幅六成。

但它没有把话说满。官方自己标注：所谓"比 Opus 5 便宜约四成"，是一个**针对典型工作负载的估算**，前提是"新模型在完成同一件任务时用的 token 更少"，而不是 token 单价又降了四成。

这句话里藏着关键。降价分成两半：一半是明码标价的单价下调，另一半是模型变"话少"了——它替你省掉的是废话，不是单价。

## 便宜的钱，被谁吃掉了
第一个吃掉它的是**用量**。单价降了两成，可如果任务量翻了一倍，总账还是涨的。模型越便宜，试用的人越多、跑的任务越长，这是行业里反复出现的现象。

第二个是**缓存**。Opus 5.5 把缓存读的价格降到五分之一，这对长期挂着跑的编程代理类任务影响最大。一场长会话里，大部分输入其实是在反复读缓存。官方给了一张示例账单：同样的 token 数下，光价格变化就让总成本降了约三成。

但如果你的用法是"问一句、答一大段"，没有缓存、输出又长，那能省的就只有两成左右。省多少，取决于你的活长什么样。

## 能力这一侧也变了
Anthropic 同时给了一组测试数字。在 Terminal-Bench 4.0 这个专门考命令行实战的测试里，Opus 5.5 拿到 66.4%，上一代 Opus 5 是 52.3%。官方还提到一个案例：有测试者用它审计并修复了一个 20 万行的代码库，耗时不到三小时。

同一天的另一侧是 OpenAI 下调 GPT-6 系列价格。两家在几天之内各自发布更便宜、更强的模型，每一次都在重新定义"一块钱能买到多少算力"。

对买方来说，眼下确实是个少有的好位置：模型在变强，价格在变低。真正的风险不是买贵了，而是刚把系统绑死在某个模型上，下一轮降价就来了。

## 普通人现在能做什么
一，**别急着签长约**。如果公司正在选模型供应商，把"可替换"写进方案里——用统一接口调用，别把业务逻辑焊死在某一家身上。

二，**算总账，不算单价**。月底统计一下自己或团队的 token 消耗结构：是缓存读多，还是长输出多。搞清结构，才知道哪一轮降价真正落到你头上。

三，**把省下的钱花在试错上**。单价降了，就该多跑几次以前"舍不得跑"的实验。这才是降价对你的真实意义。

---

来源：脑机网（https://www.logic.wang/）｜原文：https://www.logic.wang/a/njw-6cb570
本内容仅供参考，不构成投资建议。
