首页 > 开源 > 微软内部文件曝光:高管称 AI 抓取新闻是“人类历史上最大规模的劳动力盗窃”

微软内部文件曝光:高管称 AI 抓取新闻是“人类历史上最大规模的劳动力盗窃”

OSChina资讯 2026-09-21 15:42 7 阅读 查看原文

微软和 OpenAI 一直想让某些东西远离公众视线,但纸终究包不住火。

这周四,由《纽约时报》牵头的新闻原告方申请简易判决的动议被解除保密,内部文件随即曝光——新闻集团声称,这些文件显示了微软和 OpenAI 在推出 ChatGPT、Copilot 等产品之前,究竟如何看待对新闻的威胁。

最震撼的言论来自微软应用科学总监 Brent Hecht。文件显示,他多次警告称,为了训练 AI 而抓取新闻是"规模空前的惊人盗窃",甚至可能是"人类历史上最大规模的劳动力盗窃"。在一份文件中,Hecht 直接反驳了微软和 OpenAI 关于"合理使用"(fair use)的辩护,认为大规模抓取新闻的计划让"合理使用"这个概念"完全沦为笑柄"。

OpenAI 这边同样不平静。ChatGPT 负责人 Nick Turley 在内部消息中写道,基于新闻内容训练的商业产品对出版商构成"生存威胁"——因为这种产品可以替代新闻提供商。微软还有一份文件描述了一个"死亡循环"(doom loop),"同时损害我们的模型性能和整个网络"。

"一种最终产品威胁到其核心供应商的经济基础,这是极为罕见的,但这就是我们为 LLM 业务在'内容供应链'方面创造的处境。"文件这样写道。

数据表明这个预测相当准确。微软记录显示,部分新闻原告的点击率下降了 83% 到 93%,其他原告则下降了 51% 到 94%。再加上 ChatGPT 搜索结果页的低点击率,以及新闻机构自己报告的流量下降,新闻收入流失如何最终反噬聊天机器人——因为聊天机器人靠的正是那些可靠的信息流——这条链条变得越来越清晰。

Hecht 在一份微软文件中也承认:"几乎没有人会同意自己创作的内容被这样使用,也没有人为使用支付报酬。"

内部人自己也承认替代效应。微软 CEO Satya Nadella 在宣誓证词中确认,聊天机器人已能替代新闻平台——AI 平台"直接把信息给你,而不是让你去访问底层来源"。OpenAI 的一位软件工程师说得更直白:"不管我们把链接展示得多显眼,用户就是不会点击。"Turley 则描述聊天机器人"基本上就是替代品,仅此而已",并预言它们"会随着变强而越来越具有替代性"。

新闻集团的法务给出了一记重锤。代表《纽约每日新闻》等八家报纸的律师 Steven Lieberman 对 Ars 说:"这些证据首次揭示,OpenAI 和微软知道自己在做错事。"他说:"整个案件过程中,被告坚持将这些文件保密,让公众看不到。现在真相大白,世界终于能看到 OpenAI 和微软对自己行为正当性的真实想法了。"

微软方面则试图切割。发言人表示 Nadella 的证词只是对"人们获取和消费信息方式变革的"观察",不该与法庭正在审理的版权问题混为一谈",而 Hecht 的文件"只反映单个员工的个人视角,不构成法律分析,不代表公司观点"。

新闻集团还提出了更广的指控:微软将购买用于 Bing 的数据集卖给 OpenAI 用作训练数据,涉嫌违反"行业规范";OpenAI 从第三方获得了一个含 180 万篇文章的纽约时报数据集,而该第三方受协议约束不得将其用于商业用途——OpenAI 员工明知"拿它训练模型不合适",还是这么做了。

对新闻出版方来说,问题不止微软和 OpenAI。ChatGPT 发布后,Google 迅速推出 AI Overviews,开始吸收更多原本流向新闻网站的流量。新闻原告主张,如果法院不明确 AI 公司必须为新闻内容获得授权,那么新闻出版商和 AI 公司可能一起完蛋。微软内部文件也承认,生成式 AI"有'真实风险'严重扰乱"那些为训练数据做出贡献的人群的生计,甚至附了一张讽刺 LLM 自我毁灭供应链的漫画。

"AI 公司无法摆脱这个'死亡循环',因为虽然整个行业都会从每家公司付费支持创意作品生产中受益,但每家公司单独来看,免费拿内容、让别人付费才是更优解。"新闻集团指出,打破这个囚徒困境的办法只有一个——"裁定为 AI 训练复制新闻不属于合理使用,让包括 OpenAI 和微软在内的所有 AI 公司站在同一起跑线上。"

来源: