2026-09-10 · 来源:{'name': 'SiliconANGLE', 'url': 'https://siliconangle.com/2026/09/02/capsule-security-fine-tunes-nvidia-nemotron-models-to-stop-rogue-ai-agents/'}

智能体AI安全初创公司Capsule Security的新检测系统基于两款自行微调的Nvidia Nemotron模型打造,可在智能体执行动作前对其意图作出判断,由客户决定放行还是标记。
智能体AI安全初创公司Capsule Security发布了一套检测系统,并将其定位为针对失控AI智能体的“AI断路器”。该系统基于Nvidia的两款Nemotron模型构建——而且并非原版预训练权重,而是由Capsule自行微调,专门适配于一项狭窄任务:在自主AI智能体的行为演变为有害动作之前对其进行管控。
这套机制的关键在于时机。Capsule的模型并非事后审查智能体的行为,而是在其执行前的瞬间对意图动作进行权衡,再将判断结果呈现给客户,由客户决定放行还是标记。这一设计实际上在智能体的决策与执行之间插入了一道检查点——一个门控环节,力求在失控行为沦为现实动作前的最后一刻将其拦截。
选择微调Nvidia的Nemotron模型而非从零构建检测系统,是一个耐人寻味的细节。它表明Capsule认为通用基础模型家族具备足够的可塑性,可以充当安全领域专属判断任务的推理引擎:评估某个动作是否越界。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅