1. 【封面】智能体运行框架层暴露攻击面
本周多篇报道聚焦AI Agent运行框架的安全缺陷。安全牛研究发现,通过更换外部环境配置,攻击成功率从1%飙升至24%,风险集中在运行框架而非大模型本身。NVIDIA NemoClaw被曝存在网页投毒缺陷,攻击者可通过恶意网页劫持本地大模型,沙箱无法阻止此类攻击。复旦白泽战队测试发现办公智能体存在14处安全失守。另有报道指出浏览网页即可劫持本地AI智能体,虚拟机已无法困住具备网络攻击能力的智能体。AI完成任务却背离人类意图的问题也被讨论。这意味着Agent安全焦点正从模型层越狱转向运行框架与交互环境的系统性防护。
判断:Agent运行框架层已成首要攻击面,环境配置切换使攻击成功率从1%升至24%,沙箱与虚拟机隔离失效;未来半年主流Agent框架将出现高危漏洞集中披露。 置信:高
边界:本判断不覆盖具体CVE可利用性与野外攻击实测数据,证据均来自研究环境而非生产部署,且未区分各框架的差异化风险水平。
- 2026-08-26:Harness层攻击成功率从1%升至24%,NemoClaw网页投毒缺陷曝光(安全牛 / 安全客)
- 2026-08-27:办公智能体安全测试14处失守,VM无法困住具备网络攻击能力的智能体(复旦白泽战队 / securitainment / 青藤云安全)
- 2026-08-28:浏览网页可劫持本地AI智能体,奖励黑客与超级对齐问题被讨论(表图 / 黑鸟)