一个7700亿参数的大模型,权重文件从接近1.5TB被压到214GB,压缩率超过85%。这件事如果只是当技术新闻看,顶多算腾讯混元团队在2026年9月1日放出的一个轻量版模型。但把时间拉回到三天前,也就是2026年8月28日,腾讯刚刚发布并开源的Hy4 preview原版,总参数量770B,激活参数49B,上下文长度拉到1M,也就是100万个Token。据极客公园的报道,这个模型当天就进了WorkBuddy、CodeBuddy、元宝和ima,输入定价6元百万tokens,输出18元百万tokens,缓存命中只收0.3元。紧接着9月1日,轻量版上线Hugging Face和GitHub,腾讯官方给出的说法是:主流任务依然站得稳,长文理解几乎持平,多轮长上下文检索基本同一水平,数学小幅回落,日常编码、工具调用、长文档处理、常规问答都能覆盖。IT之家引述的数据更具体:MCP Atlas从83.7微降到83.2,SWE-Bench multi从82.9降到81.3。这个数字变化放在跑分榜上几乎可以忽略,但放在企业本地部署的成本表里,意义完全不一样。
商业拆解
中国
AI大模型
NO.433E17VIP会员腾讯把1.5TB压成214GB那天,企业本地的算力账本被重新翻开了
马国华 2026.09.02
“巨头把模型体重从1.5TB压到214GB,真正压扁的是自建门槛,门槛的价签才刚开始重贴。”
把真实商业世界变成训练场,让每一次推演逼近真实决策,可以进入商业判断力训练系统