2026-09-11 · 来源:{'name': 'Ars Technica', 'url': 'https://arstechnica.com/ai/2026/09/claude-users-found-ways-around-safeguards-for-bioweapons-research/'}

Anthropic旗下Claude的用户找到了绕过生物武器防护机制的方法,暴露出危险生物学研究与合法科研高度相似,令AI安全管控难度陡增。
Ars Technica报道称,Anthropic旗下Claude的用户找到了绕过防护机制的办法,而这些机制本是为了阻止这款AI助手协助生物武器研究而设。报道的核心发现令AI安全领域颇为难堪:某些危险的生物学研究看起来与合法科研极为相似,而这种相似性恰恰是让防护机制难以甄别的症结所在。
问题的本质在于“两用”模糊性。可能服务于生物武器计划的请求,完全可以套用普通科学的词汇来表述——与学术、临床和工业生物学中的术语、流程和研究路径如出一辙。当有害查询与无害查询在表面上几乎别无二致时,基于意图的筛查便失去了辨别力,那些将恶意目的伪装成正当工作的用户就能绕过针对明确意图设置的拒答机制。
这种结构性重叠迫使模型开发商做出取舍。收紧筛查,系统就可能拒绝正当的科学与医学辅助请求,损害依赖该产品的研究人员的使用体验;保持回应宽松,滥用行为就更难拦截。Ars Technica的报道指出,Claude用户……
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅