← 資訊首页 | 货源大厅

The New York Times诉讼文件曝光:Microsoft内部文档称AI网页抓取是“令人震惊的窃取”

2026-09-19 · 来源:{'name': 'HotHardware', 'url': 'https://hothardware.com/news/microsoft-exec-warned-ai-web-scraping-makes-a-mockery-of-fair-use'}

The New York Times诉讼文件曝光:Microsoft内部文档称AI网页抓取是“令人震惊的窃取”

The New York Times诉Microsoft与OpenAI案中曝光的内部文件显示,其中一份Microsoft文档将AI网页抓取称为“令人震惊的窃取”,与外界批评者对其剥削劳动的指控相互印证。

围绕生成式AI的版权大战曝出一个尴尬的内幕:通过The New York Times诉Microsoft与OpenAI案浮出水面的内部文件显示,对网页抓取的疑虑并非只存在于这项技术的外部批评者当中。

生成式AI最激烈的反对者长期将这项技术斥为赤裸裸的劳动窃取,理由正是网页抓取与模型训练的实际运作方式。而根据该案中曝光的材料,这类保留态度在公司内部同样存在。一份Microsoft内部文档直指这种做法是“令人震惊的窃取”。源报道还提到,一位Microsoft高管曾警告,AI网页抓取是对合理使用的公然嘲弄——而合理使用恰恰是AI开发者普遍援引来为摄取网络公开内容辩护的同一法律原则。

这一曝光的意义不仅在言辞,更在程序层面。由于这些文件是通过The New York Times诉Microsoft与OpenAI案进入案卷记录的,起诉方如今可以直接援引两家公司自己的表述。对于高度依赖合理使用原则的辩方来说,内部文件中把抓取称作窃取、并形容其嘲弄了这一法律原则的措辞,等于给原告送上了极具说服力的呈堂证供,也让“用抓取来的网络内容训练模型是常规做法、法律上早有定论”这一公开叙事愈发难以自圆其说。

对更广泛的AI算力与数据生态而言,这一事件凸显出训练数据来源问题仍是一项悬而未决的法律与声誉风险。行业在公开场合高举合理使用大旗,与Microsoft内部文件中记录的怀疑态度之间落差巨大,这为生成式AI的批评者提供了有力的论据,也让“网页抓取的训练材料究竟该由谁埋单”这一问题继续摆在法院面前,无法回避。


萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅