成立六个月,三轮融资拿走4亿美元,估值站上14.2亿美元,这家叫Naive AI的公司却公开放弃从零预训练,直接拿国内开源权重搭自己的同名模型。按公开披露信息,这三轮融资总额与14.2亿美元估值均来自企业披露口径,成立时长六个月亦同。把最烧钱的基础模型训练从账本里划掉,却让资本愿意在这么短时间内连投三轮,这个反差本身就是个值得拆开的商业切口。
先算从零预训练那本账。千亿参数模型单次完整训练,算力、数据清洗、失败重跑全部打进去,综合成本落到大几千万到上亿美元区间。对一家账上4亿美元的公司来说,这笔钱一旦烧进去,后续每一轮迭代都得继续追加,等不到模型能力追上头部玩家,现金流先见底。放弃预训练,不是技术路线怯懦,是把一笔刚性成本从利润表里整块挪走。所谓“保密初创”,六个月里外界能看到的产品细节可能不多,公关口径或许收得很紧,资本却愿意给到14.2亿美元估值,说明投资方押的就不是训练能力。这个估值只能往交付、入口和不可替代的服务属性上去找支撑。