首页
学习
活动
专区
圈层
工具
发布

Prompt 注入:为什么网页里的一句话就能劫

AI 助手越聪明,越容易被网页里的隐藏指令骗。

问题出在通道混了:系统指令和网页数据全变成一串文本。模型没法分清哪句该听、哪句只是资料。

直接对话还能控范围:用户顶多套出点提示词。但要是把恶意指令藏在网页或邮件里,就麻烦了。

间接注入才是真危险:只要 AI 去读,就会中招。微软的 Copilot 就被坑过。一封带隐藏代码的邮件,能让它在后台偷发邮件。连安全过滤都没拦住。要是给 AI 开了运行代码的权限,风险更大。

老办法防不住:让模型“忽略恶意指令”没用。它俩都在同一个通道里吵。加过滤器或者分隔符也容易被绕过去。

解法得靠外部把关:别让 AI 自己管自己。让它只干读资料的脏活,别碰工具钥匙。真正调用工具的活,交给普通代码审批。高危操作必须人工确认,还得收紧权限。

说白了,底层架构不改,这漏洞就堵不死。用 AI 可以,但千万别把万能钥匙交给它。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OnU3hDjco3NVigurLRl37iFg0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券