功能概述
意图行为检测是面向 AI Agent 应用的安全防护能力。它分析 Agent 运行过程中的完整执行轨迹(包括用户原始请求、模型思考、工具调用及参数、工具/环境返回、最终回复),输出安全判定、风险类别与判定理由,用于识别提示词注入、工具滥用、供应链污染等意图攻击,降低业务风险。
检测能力
意图行为检测从用户输入、环境信息、外部工具及自身缺陷四类入口识别风险,包括目标劫持、工具滥用与利用、供应链污染等意图风险类型。完整规则项以控制台展示为准。
配置步骤
前提条件
已通过 SDK/API 接入 方式将 AI Agent 业务接入大模型安全功能。
已调用 DescribeLLMContentSecCheck 接口将意图行为检测内容 AgentTrace 上报至大模型安全功能。
操作步骤
1. 登录 Web 应用防火墙控制台,在左侧导航栏选择大模型安全 > SDK 接入。
2. 在目标应用的操作列,单击防护配置。
3. 在防护配置区域,打开意图行为检测功能开关。
4. 单击意图行为检测,切换至意图行为检测页签。
5. 在规则列表中,找到需要启用的规则,单击右侧规则开关将其打开。
6. 在执行动作列下拉框中,选择命中后的处理方式:
观察:记录命中日志,不阻断请求。在策略上线初期可优先选择该动作,便于评估误报率。
拦截:阻断请求,并返回拦截提示。对于输入内容,将阻断用户发往源站的请求;对于输出内容,将停止模型输出并返回提示信息。
7. 如需对多条规则进行批量操作,可勾选规则前的复选框,单击列表上方的批量配置,统一调整执行动作和规则开关。
注意事项
意图行为检测仅支持通过 SDK/API 接入的大模型安全业务,需业务侧在调用时传入 Agent 运行过程中的完整执行轨迹,未传入完整 AgentTrace 的场景下检测能力会受限。
检测日志可通过 日志审计 查询,支持回溯分析。
相关文档
日志审计