商业拆解
美国
VIP会员

11,000 篇教程,正在撬动 AI 训练数据的付费墙

向澜 2026.08.26

训练数据的免费时代正在被逐案拆解,谁能定义授权接口,谁就握住了下一阶段的成本开关。

如果一家网站的内容主要是“怎么修马桶”和“怎么烤磅蛋糕”的分步图文教程,你大概不会把它跟全球最值钱的 AI 实验室放在同一个谈判桌上。但 2026 年 8 月 21 日这个假设被打破了。据路透社报道,全球最大的协作式「怎么做」指南网站 WikiHow 当天向美国曼哈顿联邦法院提起诉讼,指控 OpenAI 未经许可抓取了超过 11,000 篇教程文章,用于训练 ChatGPT 及 GPT 大型语言模型,并侵犯了至少 1,200 项已注册版权。IT之家在 8 月 25 日转述了路透社的报道,OpenAI 发言人在 8 月 24 日给出的回应是:“使用公开数据训练,并以合理使用为基础。”

先说说 WikiHow 这个主体。它不是一家内容供应商,而是一个协作式内容生产网络。核心资产就是那些分步骤的“怎么做”文章:从修水管、除草坪到处理法律纠纷、医疗紧急情况。这些文章的生产成本不在服务器和带宽,而在人。每一篇分步指南背后,是作者的研究、编辑的校验、社区的修订。WikiHow 在诉状中的指控相当直白:OpenAI 大规模复制这些内容后,ChatGPT 能够根据用户提示复现 Wik...

把真实商业世界变成训练场,让每一次推演逼近真实决策,可以进入商业判断力训练系统