一边是第二季度经营亏损超过一百二十亿美元,相当于每换来一美元收入,要承受约一点八美元以上的营业亏损;另一边,OpenAI 却在这个十月发布了内部前沿模型产出的全新数学研究成果;如果沿着一种可能的路径推演,它或许会把这些成果用一种叫 Lean 的形式化验证语言写成可公开复现的证明代码,并同步披露完成这些证明所对应的算力基准。这不是一家烧钱公司在故作学术姿态,而更像是一场关于什么才算有效 AI 进步的重新定义。
按照 OpenAI 对外说法,它已与普林斯顿高等研究院数学与人工智能独立顾问组磋商,并参考其意见与公开建议确定发布方式。这个细节本身很关键,因为它说明发布格式并不是公司内部随手决定,而是提前引入了外部学术信用体系。
把时间线稍微拉长一点。2026年以来,AI 数学这条赛道已经挤进了 Google DeepMind、Anthropic、OpenAI 和国内字节跳动、DeepSeek、腾讯等玩家。第一财经在一篇关于 AI 数学的梳理中写到,当前主流模式是:大模型先给出推导思路,再由 Lean 逐条核查逻辑漏洞,出现错误就即时反馈,模型修改到证明通过为止。这...