不知道你发现没有,过去两年大家聊大模型,眼睛都盯着云端那一堆堆的服务器,参数越大越兴奋,动辄几百B、上千B。可就在大家还在比谁家云上算力更猛的时候,科大讯飞干了件挺有意思的事。根据证券日报的报道,2026年8月31日,科大讯飞宣布要在9月1日开源两款端侧通用大模型,一个是星火X2.5-4B,一个是星火X2.5-1.7B,原生支持最长1M token的上下文窗口。紧接着9月7日,他们要正式发布星火X2.5(293B)基座模型。时代周报那边也提到,今年1024开发者节上,讯飞还会推出一个基于全国产算力的全新主力通用大模型。你看这个节奏:先放两个“小个子”端侧模型开源,再预告一个近三百B的基座大模型。一边是参数只有几个B的“轻骑兵”,一边是冲着能力天花板去的“重型基座”,这个组合本身就说明了一件事——AI算力的分配逻辑,正在悄悄从“全往云上堆”变成“端云两头算”。
深度洞察
中国
开源大模型
NO.861BC5VIP会员当大模型开始往手机里钻,算力的账本正在被重新翻开
沈曼 2026.09.01
“端侧模型开源的本质,是把AI算力的物理出口从云端数据中心搬进了千万台终端设备,而每一个新出口的背后,都绑着芯片、产能和装机体量三道硬门槛。”
把真实商业世界变成训练场,让每一次推演逼近真实决策,可以进入商业判断力训练系统