商业拆解
中国
VIP会员

阿里Qwen3.8-Flash把API价格打到Opus的3%,这笔账到底怎么算?

马国华 2026.08.27

训练成本降九成的工程能力,正在把AI竞争的焦点从“谁的模型更强”拽进“谁的推理供应链更狠”。

一个模型一边把每百万Token的输入价格压到一块钱,另一边却传出来要对大型商业用户按收入抽成。你如果只看前者,会以为阿里在烧钱抢市场;只看后者,又觉得它想学Kimi收“模型税”。但把这两件事放进同一张成本账里算,你会发现它们其实是同一个策略的两个侧面:先用工程能力把模型训练和推理的单位成本打穿,再用商业许可把赚差价的通道重新捏回自己手里。这不是价格战,这是一次对AI模型交付成本的重新定价。

2026年8月26日晚,阿里巴巴发布并同步开源了Qwen3.8-Flash。据北京商报、网易科技、和讯网报道,这款模型采用全新下一代架构(Next架构),是一个多模态稀疏专家模型(MoE,也就是让模型内部多个专家模块按需激活、不用全部运转),Transformer参数125B,每次仅激活6B。官方公布的推理价格为每百万Tokens输入1元、输出3元。多家媒体测算,这一价格约为Anthropic旗下Claude Opus4.6的3%。同一时间,国内大模型行业正在经历一轮集体涨价:据青岛财经网报道,腾讯云年内两次上调API价格,智谱AI完成三次API调价,DeepSeek在8月17日宣...

把真实商业世界变成训练场,让每一次推演逼近真实决策,可以进入商业判断力训练系统