深度洞察
美国
AI大模型
专享

当标价开始失效:每百万token跌了,为什么你的推理账单没有变薄?

沈曼 2026.10.08

“当整个行业还在为每百万token的标价贴身肉搏时,真正的成本话语权已经顺着云平台的物理机柜悄悄渗走了。”

2026年10月8日,财联社披露,美国人工智能公司Anthropic发布Claude Haiku 5.5,专为高并发、成本敏感任务设计,财联社的原话是“到手价将明显低于4.5版”。行业里另一条容易被忽略的消息是,OpenAI(推出ChatGPT的那家美国人工智能公司)的GPT6.1 Sol把标准API(应用程序编程接口,开发者调用模型能力的接口)缓存输入价格压到每百万token(模型处理文本的最小单位,相当于字词片段)0.10美元。而智东西早前报道的Anthropic Sonnet 5.5缓存读取操作价格,仍停在每百万token 0.20美元。一个降标价,一个降缓存价,推理价格战就这样从模型单价烧进了前几年没人细看的缓存读取环节。

这个反差背后藏着很多开发者的账单痛点。一位开发者给西瓜浏览器动画项目做成本拆解,缓存上下文数据花了3.6美元,缓存写入花了1.8美元,这两项加起来5.4美元,占整个任务成本的六成以上。每百万token单价降了,但缓存读取、上下文重建这些隐性消耗不降,月底账单照样下不来。

把真实商业世界变成训练场,让每一次推演逼近真实决策,可以进入商业判断力训练系统
当标价开始失效:每百万token跌了,为什么你的推理账单没有变薄? - AIFUC | 商业决策