刚看到几条新闻,串在一起,味很冲。7月27日,据Business Insider报道,微软为了缓解内部AI业务的算力焦虑,已经把给开发者用的GitHub搬到了亚马逊云(AWS)上,甚至一度想租甲骨文(Oracle)的云服务器,最终因安全合规担忧才作罢。再看一周前,谷歌母公司Alphabet刚发的二季报,单季资本支出干到了449亿美元,直接把全年预算指引拉高到了2050亿美元的天际线。与之形成鲜明对照的,是前阵子OpenAI工程师那则看似不起眼的内部透露:据The Information 6月底的消息,他们通过系统优化,把模型推理成本给干低了50%以上。
这就引出了今天想聊的核心悖论:一边是科技巨头们在算力基建上杀红了眼,筹码堆得比楼还高;另一边,却是最懂模型成本的OpenAI在疯狂压降单次调用成本。这背后,其实藏着美国企业界正在发生的一场无声的集体转向——大模型调用,正在从豪放的“Token最大化”时期,骤然迈入斤斤计较的“成本节制”年代。咱们把账本当众摊开,看看这背后究竟是人性的扭曲还是财务的沦丧。
