腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
首页
专栏
文章归档
2026 年 06 月 22 日文章目录
人形机器人还在学习干活,灵巧手先成了热门生意
顶会顶刊AI安全论文研读第二十六期:ICLR 2026 | 你下载的 LoRA 可能藏着"越狱后门"
顶会顶刊AI安全论文研读第二十五期:AAAI 2026 | MAJIC:用马尔可夫自适应策略组合提升黑盒越狱攻击效率
顶会顶刊AI安全论文研读第二十四期:ICLR 2026 | LingoLoop:利用语言学上下文与状态陷阱诱导多模态大模型陷入无限循环
顶会顶刊AI安全论文研读第二十三期:arXiv 2026 | CIA:黑盒场景下基于LLM的多智能体系统通信拓扑推断攻击
顶会顶刊AI安全论文研读第二十二期:ACL 2026 | GAMBIT:多模式大语言模型的游戏化越狱框架
顶会顶刊AI安全论文研读第二十一期:ICLR 2026 | 面向MCP协议的LLM智能体安全攻击基准测试
AI时代“皇帝的新衣”:你想做皇帝,还是小男孩? | "小龙虾”狂热引发的AI原生安全警示
顶会顶刊AI安全论文研读第十八期:AAAI 2026 | ExtendAttack:通过延长推理攻击大推理模型服务器
顶会顶刊AI安全论文研读第十七期:AAAI 2026 | Phantom Menace:探索并增强VLA模型对物理传感器攻击的鲁棒性
顶会顶刊AI安全论文研读第十六期:AAAI2026 | Fact2Fiction: 针对智能体事实核查系统的定向投毒攻击
顶会顶刊AI安全论文研读第十五期:AAAI 2026 | MPMA:针对模型上下文协议(MCP)的偏好操纵攻击
顶会顶刊AI安全论文研读第十四期:NeurIPS 2025 | BadVLA:基于目标解耦优化的视觉-语言-动作模型后门攻击研究
顶会顶刊AI安全论文研读第十三期:ICLR 2025 | 坏机器人:物理世界中具身大语言模型的越狱攻击
顶会顶刊AI安全论文研读第十二期:EMNLP 2025 | AGENTVIGIL:面向黑盒大语言模型智能体的通用自动化红队测试框架
顶会顶刊AI安全论文研读第十一期:ACL 2025 | 内存提取攻击:揭示LLM智能体内存中的隐私风险
系统扛得住,不代表模型可信:AI 原生安全成为高价值攻击面
WorkBuddy 实操:从零基础到生产力翻倍,我的 5 个高频使用场景
顶会顶刊AI安全论文研读第十期:ACL Findings 2025 | Mousetrap:利用迭代混沌链欺骗大型推理模型越狱
顶会顶刊AI安全论文研读第九期:ACL 2025 | 围攻智能体:利用优化提示攻击破解实用型多智能体大语言模型
第 3 页
第 4 页
第 5 页
第 6 页
第 7 页
第 9 页
第 10 页
第 11 页
第 12 页
第 13 页
领券