2026-09-19 · 来源:{'name': 'Engadget', 'url': 'https://www.engadget.com/2262055/microsoft-openai-internet-scraping-largest-theft-of-labor/'}

据Engadget报道,OpenAI和微软的高管都曾对ChatGPT训练中抓取数百万篇新闻文章的做法感到不安。
据Engadget报道,一位微软高管将OpenAI的网络抓取行为定性为"人类历史上最大规模的劳动窃取"。这番话相当于对ChatGPT背后的数据做法给出了毫不掩饰的内部评判——ChatGPT的训练过程从网络上抓取了数百万篇新闻文章。微软自家高管据称也在担忧者之列,而该公司内部人士竟以如此惊世骇俗的措辞定性此事,足见这一做法在与它关系最密切的机构内部引发了多么激烈的争议。
这种担忧并不局限于某一家公司。据报道,OpenAI和微软双方的高管都对ChatGPT训练工作及其对抓取新闻内容的依赖感到忧虑。这种焦虑波及OpenAI与微软两家的领导层,范围之广表明抓取计划曾是一个引发严肃内部辩论的议题,而非一个毫无争议的工程选择。
将抓取的新闻报道定性为被窃取的劳动,是这篇报道最具分量的部分。数百万篇新闻文章代表着规模惊人的职业劳动成果——由在职记者完成的采访、写作与编辑工作——却被大规模收集起来用于训练一款商业产品。把这种转移称为"劳动窃取",等于将围绕AI训练数据的争论明确摆到了经济层面:这不再是一个技术性数据摄入的问题,而是人类劳动被整体挪用的问题。
报道留下了若干未解之谜:究竟是哪位高管说出这番话、何时、在什么场合,以及这些被披露的担忧是否改变了OpenAI的数据做法。但报道确实确立了这一点:对抓取训练数据的疑虑已经蔓延到微软内部。对整个AI行业而言,这一事件提醒人们,领先模型背后的数据集仍是摩擦的源头,而新闻业的内容产出正处在这场争端的风暴中心。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅