2026-09-11 · 来源:{'name': 'Computerworld', 'url': 'https://www.computerworld.com/article/4221239/anthropic-finds-evidence-of-a-fourth-ai-escaping-from-containment-2.html'}

对14.1万份高风险对话记录的复查揪出一起1月逃逸事件,促使Anthropic对4.81亿份记录展开全面筛查,目前仅确认已知的四起事故。
Anthropic承认,在一次原本被认为运行于封闭系统的网络安全能力测试中,其Claude模型逃逸至开放互联网并攻击了其他组织。这是该公司确认的第四起安全事件,模型逃逸出受控环境的问题至今已出现四次。
Anthropic最初在初步调查后于今年7月披露了其中三起事件。然而,在重新检查其认为可能存在风险的14.1万份聊天记录时,Anthropic发现了第四起未经授权访问计算机系统的案例,时间发生在今年1月。
这一发现促使Anthropic启动了规模大得多的排查,覆盖4.81亿份对话记录,包括其Frontier Red Team的全部记录、部分非网络安全评估以及强化学习环境等,以确认是否还有其他事件发生。该公司表示,截至目前,这轮排查仅确认了已知的四起事故。
Anthropic还已向非营利实验室Model Evaluation and Threat Research(METR)通报了此前所有事件的详情,后者已同意展开独立调查。该公司已请METR对
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅