← 資訊首页 | 货源大厅

'Project Lilly'曝光:OpenAI雇数百名外包人员人工审读ChatGPT对话记录

2026-09-15 · 来源:{'name': "Tom's Hardware", 'url': 'https://www.tomshardware.com/tech-industry/artificial-intelligence/chatgpt-transcripts-are-reportedly-read-by-humans-to-improve-responses-including-those-with-personal-information-project-lilly-has-seen-openai-hire-hundreds-of-contractors-to-manually-review-logs'}

'Project Lilly'曝光:OpenAI雇数百名外包人员人工审读ChatGPT对话记录

404 Media调查称,OpenAI的'Project Lilly'项目雇用数百名承包商阅读ChatGPT对话记录——其中包含用户个人信息的对话也在审查范围——以改进模型回答质量。

据404 Media报道,OpenAI招募了数百名承包商,其工作是人工阅读并评估ChatGPT对话内容。这一项目被该媒体称为'Project Lilly',由人工审查员检视聊天机器人日志,目标是打磨模型回答的质量。值得注意的是,被审查的对话记录中包括用户分享了个人信息的会话,凸显出这些外包人员可接触真实用户互动的范围之广。

这篇报道(Tom's Hardware也进行了跟进)揭示出AI生产流水线中一个基本不为人知的环节:负责给模型输出打分、检查和排障的人力队伍。当行业注意力大多集中在芯片、算力集群和训练预算上时,Project Lilly表明,人工对话级审查仍然是一款旗舰聊天机器人持续改进的核心手段。数百名承包商的规模意味着这是一项庞大且持续的运营,而非偶尔为之的抽查。

对于正在权衡是否部署ChatGPT的企业而言,这一发现具有现实意义。人工审查对话记录——包括含个人信息的记录——意味着提交给助手的提示词可能被外包人员阅读,这对处理敏感数据或在严格合规制度下运营的机构来说是必须考量的因素。404 Media将这种做法描述为OpenAI改进回答质量努力的一部分,但这一披露势必会引起注重隐私的企业客户的审视,他们正在评估自己的交互数据究竟是如何被处理的。

这篇报道还揭示了AI产品背后的人力经济账。在算力预算之外,还有一支受雇评估和为模型输出打分的劳动队伍——他们的工作会接触到包含个人信息的对话。随着各家厂商在回答质量上展开竞争,此类报道表明,竞争并不止于硬件:它还延伸到阅读用户日志的外包人员队伍。这提醒人们,前沿AI的运转既依赖芯片,也同样依赖人力。


萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅