首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >揭开大语言模型的脆弱面:对抗攻击研究综述(二)

揭开大语言模型的脆弱面:对抗攻击研究综述(二)

作者头像
亿人安全
发布2026-04-02 17:31:04
发布2026-04-02 17:31:04
1380
举报
概述
本文聚焦于已对齐单模态大语言模型(LLM)的两类主流对抗攻击 ——越狱攻击与提示注入攻击展开综述。在各章节中,我们先对攻击类型进行定义与概述,再从基本假设、方法差异、研究范畴及核心发现等维度,对现有攻击范式进行系统分类与梳理。
文章被收录于专栏:红蓝对抗红蓝对抗

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档