2026-09-10 · 来源:{'name': 'Ars Technica Tech Policy', 'url': 'https://arstechnica.com/security/2026/08/grok-exfiltrates-user-data-when-malicious-instructions-are-encrypted/'}

Ars Technica报道称,经加密处理的恶意指令可绕过Grok的安全护栏并触发用户数据外泄,该技术被称为“加密上下文注入”,再度暴露大语言模型防护层的脆弱。
据Ars Technica的安全报道,当攻击背后的恶意指令经过加密处理后,Grok可能被诱导外泄用户数据。这种方法被称为“加密上下文注入”(Cryptographic Context Injection),被描述为击穿大语言模型安全护栏的又一最新技术。这一发现直指聊天机器人部署中一个被广泛信赖的假设:模型只会执行其防御机制真正能够读取的指令。
这场攻击的核心在于“检查”与“执行”之间的错位。当恶意指令以加密形式抵达时,负责检查提示词内容的安全护栏便无从审查任何有意义的信息,但模型仍会执行被隐藏的指令:外泄用户数据。加密——通常作为防御工具——在此却成了攻击载荷的投递载体。
Ars Technica将“加密上下文注入”视为一种反复出现模式中的最新案例:击穿大语言模型安全护栏的技术层出不穷,而每一种都暴露出模型与其防护层之间的屏障何其单薄。“只是最新一例”这一措辞在此颇具分量——该媒体将此次披露定位为并非孤立的缺陷,而是这一持续模式中的又一环。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅