帮你快速理解、总结文档立即下载

概述

最近更新时间:2026-09-03 17:43:31
我的收藏

什么是大模型安全

大模型安全是腾讯云 WAF(LLM-WAF)针对大模型应用场景推出的专项安全防护方案,为大模型应用提供从输入、输出到工具调用的全链路实时检测与防护能力。

功能定位

随着大模型在企业客服、内容生成、知识问答、AI Agent 等场景的广泛应用,模型应用面临三类核心风险:
内容安全风险:用户输入包含越狱指令、角色扮演等 Prompt 注入攻击,或模型输出违规内容。
数据安全风险:模型在交互中泄露企业敏感数据或用户个人身份信息(PII)。
服务滥用风险:恶意用户通过高频请求或巨量 Token 消耗发起算力滥用攻击。
大模型安全基于腾讯云 WAF 的流量代理与检测引擎,提供多模型、多场景、高并发环境下的防护能力,帮助企业构建可信、稳定、可持续的大模型服务。

核心功能

大模型安全提供以下防护能力:
防护类型
能力说明
适用场景
内置 Prompt 注入攻击检测引擎,识别越狱指令、角色扮演、身份伪造等常见攻击手法,拦截恶意输入。
所有面向用户的大模型应用。
对大模型输入和输出进行合规性审核,识别违规内容,分级管控。
需要满足内容安全合规要求的场景。
对模型发起的工具调用进行鉴定与意图识别,阻止危险命令执行,保护工具调用链安全。
集成 Function Calling / Tool Use 的 AI Agent 场景。
分析 Agent 运行过程中的完整执行轨迹(包括用户原始请求、模型思考、工具调用及参数、工具/环境返回、最终回复),输出安全判定、风险类别与判定理由。
需要对 AI Agent 完整执行轨迹进行安全意图判别的场景。
基于数据分类分级引擎实时检测交互中的敏感数据,覆盖个人身份信息、金融账户信息、凭证密钥等特定数据类型。
涉及用户隐私或企业内部数据交互的场景。
面向 AI Agent Skill 的准入安全检测,覆盖供应链风险、命令注入、网络外传及 Prompt 注入等风险维度。
AI Agent 生态中 Skill 上架审核、内部安全准入。
按用户维度实时检测请求频次和 Token 消耗量,支持限流告警与拦截。
需要控制大模型 API 使用成本的场景。
支持自定义关键词库、正则表达式、编码类型识别、数据分类等多维匹配条件,灵活构建专属防护策略。每条规则可叠加多个匹配条件,优先级高于平台预置规则。命中后支持观察、拦截,或使用 安全代答 作为响应内容。
有自定义业务合规要求的场景。

应用场景

场景一:智能客服

企业通过大模型构建智能客服系统,用户与模型进行多轮自然语言对话。在此场景下,根据客户设置的安全策略,大模型安全支持:
拦截用户通过提示词注入尝试越狱客服模型
检测模型输出中是否存在违规内容
防止用户通过对话诱导泄露企业内部敏感信息
通过算力消耗防护控制单用户请求额度

场景二:AI 内容创作

将大模型嵌入内容创作平台,用户通过 Prompt 生成文章、图片描述等创作内容。在此场景下,根据客户设置的安全策略,大模型安全支持:
检测用户输入中包含违规引导内容
阻止模型受诱导输出大量受版权保护的原文或源码
通过敏感数据检测防范模型交互中泄露创作者身份信息的风险

场景三:企业知识库问答

基于企业私有知识库的 RAG(检索增强生成)问答系统,模型需要结合企业内部文档回答问题。在此场景下,根据客户设置的安全策略,大模型安全支持:
阻止通过提示词注入诱导模型泄露系统提示词或内部文档
检测模型回答中是否附带企业敏感数据(数据库连接串、密钥、员工信息等)
通过内容合规检测确保问答内容符合企业内容安全政策

场景四:AI Agent / 工具调用

在 AI Agent 场景中,大模型通过工具调用(Tool Call)执行外部操作,如查询数据库、发送消息、调用第三方 API。在此场景下,根据客户设置的安全策略,大模型安全支持:
通过 Tool Call 防护拦截针对工具调用的恶意操纵
通过 Skill 安全检测对第三方 Skill 包进行安全准入审核
通过内容合规检测和提示词攻击防护保障 Agent 交互安全

接入方式

大模型安全提供多种接入方式,您可以根据业务架构和能力需求进行选择。

对比维度
流量接入(域名接入)
SDK/API 接入
大模型服务平台 TokenHub 接入
接入方式
CNAME/CLB 挂载
直接调用 API
请求经大模型服务平台 TokenHub 后端服务转发
代码改动
无需改动
需集成 SDK,调用云 API
无需改动
域名迁移
需要 DNS/CLB 配置
不需要
不需要
SSE 流式支持
支持
支持
支持
适用架构
网关代理式
灵活嵌入式
大模型服务平台 TokenHub 代理式 / 集中式防护
若业务部署在腾讯云上且可统一接入 WAF,建议选择 流量接入
若使用自建 AI Agent、不希望流量经过 WAF,或需要使用多模态检测和针对大模型场景的预置检测项,建议选择 SDK/API 接入
若业务已通过大模型服务平台 TokenHub 网关统一汇聚模型调用、希望零改造零运维地对大模型服务平台 TokenHub 上的所有模型推理服务集中开启安全防护,建议选择 大模型服务平台 TokenHub 接入

开通方式

详细套餐与计费说明,请参见 计费概述

包年包月

1. 登录 Web 应用防火墙控制台,在左侧导航栏选择大模型安全,单击立即开通
2. 在开通弹窗中选择套餐类型,单击立即开通

按量计费

按量计费模式仅支持 SDK/API 业务接入,按小时计量,T+1天按天出账。如需开通请联系客户经理。