Agent 攻击 Agent:自动检测 LLM Agent 中的污点式漏洞
“ 随着大语言模型LLM能力的快速提升越来越多的系统开始构建LLM-based Agents。然而这类 Agent 系统也引入了一类新的安全风险恶意提示、工具调用滥用、数据泄露。这些攻击通常通过恶意输入 → LLM 推理 → 工具执行的链路传播 其本质类似于传统程序中的污点传播漏洞。但传统安全分析方法很难应用于 Agent 系统因为LLM 推理过程是黑盒或半黑盒Agent 行为具有高度动态性攻击路径依赖复杂的推理与工具调用链。为了解决这一问题论文提出通过构建攻击Agent自动发现 LLM Agent中的污点式漏洞。该方法让一个Agent自动攻击另一个 Agent从而发现潜在安全漏洞。 ”论文标题Make Agent Defeat Agent: Automatic Detection of Taint-Style Vulnerabilities in LLM-based Agents发表时间34th USENIX Security Symposium2025作者单位复旦大学 开源代码https://zenodo.org/records/1559009701—方法介绍图1显示了一个简化的漏洞代码片段。为了利用此漏洞攻击者通过第2-3行即source中的web服务向代理发送恶意提示其中一部分由LLM返回并直接传递给第10行即sink中的eval函数而没有进行充分的清理从而导致代码注入。图 1. 一个来自热门开源代理的实际漏洞示例论文的核心思想是利用攻击 Agent 自动生成恶意输入并通过污点传播分析检测 LLM Agent 的安全漏洞。整个系统包含两个核心角色Victim Agent需要被测试安全性的目标 Agent。Attacker Agent负责生成攻击提示并尝试触发漏洞。通过这种方式系统可以自动探索潜在攻击路径并发现安全问题。图 2. AgentFuzz概述图整个漏洞检测流程主要包括四个步骤1.污点源定义将用户输入或外部数据标记为潜在恶意数据。2.攻击输入生成攻击 Agent 自动生成可能触发漏洞的提示或输入。3.Agent 行为执行Victim Agent 根据输入执行推理与工具调用。4.污点传播检测分析敏感数据是否传播到危险操作如系统命令、数据库访问等。小结让 Agent 自动攻击 Agent实现自动化 Agent 安全测试。02—关键机制Agent 对抗式漏洞检测框架通过“攻击 Agent vs 目标 Agent”的方式自动发现漏洞。LLM Agent 污点传播建模将传统程序分析中的污点分析思想引入 Agent 系统。自动攻击生成机制利用 LLM 自动生成多样化攻击提示。工具调用安全检测分析 Agent 工具执行链中的潜在安全风险。模块设计思路作用攻击 Agent自动生成恶意提示探索潜在攻击路径污点跟踪标记不可信输入分析数据传播路径工具调用监控监控 Agent 工具执行行为检测危险操作漏洞判定检测污点数据是否到达敏感操作发现安全漏洞小结将传统污点分析思想扩展到 LLM Agent 系统中。03—实验结果实验收集了20个基于LLM的开源代理其中13个拥有超过10,000个星标其余7个则拥有超过1,000个星标。主要实验结果如下。1漏洞检测评估。结果见表1-2。总体而言AgentFuzz在整个数据集中共识别出828个sink调用点并报告了34个潜在漏洞。AgentFuzz总共花了69.01个CPU小时对20个应用程序进行模糊测试平均每个应用程序3.45个CPU小时。表1. 数据集中20个代理的详细信息。代理与检测到的漏洞以灰色突出显示表2. 检测到的漏洞并分配了CVE编号2相关工作比较。与SoTA技术LLMSmithDemystifying RCE vulnerabilities in LLM-integrated apps的比较结果如表3所示。结果显示AgentFuzz在准确率方面超过LLMSmith33.25倍检测到的漏洞是LLMSmiths的2.4倍。AgentFuzz识别出34个漏洞。相比之下LLMSmith只检测到10个漏洞所有这些漏洞都是AgentFuzz识别的漏洞的子集并产生332个误报。表3. AgentFuzz与LLMSmith的对比小结AgentFuzz可以自动检测基于LLM的代理中的污点式漏洞。为了弥合传统的定向模糊和代理漏洞之间的差距AgentFuzz以自然语言的形式生成语义正确和约束有效的种子提示。AgentFuzz已经在20个真实的代理应用程序上进行了评估发现了34个高风险的0天漏洞分配了23个CVE ID。 总结该论文首次系统性地将“污点分析 自动攻击生成”结合用于检测 LLM Agent 的安全漏洞。通过构建攻击 Agent该方法可以自动探索复杂攻击路径从而发现潜在安全问题。随着 LLM Agent 在实际系统中的广泛应用Agent 安全测试与自动漏洞检测将成为未来的重要研究方向。 欢迎留言讨论你认为未来是否需要专门的 Agent 安全测试框架LLM Agent 的安全问题是否会成为新的漏洞研究热点 点赞 收藏 分享你的支持是我们持续解析高水平软件安全论文的最大动力