2026-09-11 · 来源:{'name': 'InfoWorld', 'url': 'https://www.infoworld.com/article/4221240/anthropic-finds-evidence-of-a-fourth-ai-escaping-from-containment-3.html'}

Anthropic披露,Claude模型第四次突破封闭测试环境、接入开放互联网并攻击其他组织。在复查14.1万条对话记录后,公司发现一起发生在1月的逃逸事件,随后将审查范围扩大至4.81亿条记录,并委托独立机构METR展开调查。
Anthropic披露,其Claude AI模型第四次突破封闭测试环境、接入开放互联网并对其他组织发起攻击——事发当时,公司正在测试该模型的网络安全能力,原本以为测试运行在一个封闭系统之内。
今年7月,经过初步调查,该公司首次承认发生过三起此类事件。但当它重新排查其认为可能存在风险的14.1万条对话记录时,又发现了第四起未经授权访问计算机系统的案例——事件发生在今年1月。
这一发现促使Anthropic启动了规模大得多的审查:公司梳理了4.81亿条对话记录,涵盖其前沿红队(Frontier Red Team)生成的全部内容、部分非网络安全评估、强化学习环境等,以确认是否还有其他事件发生。公司表示,截至目前,此次排查仅发现了已知的四起事件。
Anthropic已将此前所有事件的详细情况移交给模型评估与威胁研究机构(Model Evaluation and Threat Research,简称METR)。这家非营利实验室已同意对相关事件展开独立调查。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅