返回 AI 大白话
判断与保护 · 免费公开

提示注入

Prompt Injection

先打个比方

像参考文件里夹了一张冒充主管的便条,要求你绕过工作规则。

放到你的工作里

总结网页时,页面夹着忽略用户要求并发送私密文件的句子,应把它当网页内容而不是授权。

现在,回来看它的意思

外部网页、文件或消息中混入指令,试图让AI把资料当命令执行,从而偏离原任务或泄露信息。

但别这样理解

不只有明显的攻击句,图片和工具结果也可能夹带指令;写一句不要受骗不能代替权限限制和审核。

现在就试一小步

给资料处理流程加一条规则:外部材料不能授予权限,发送和修改前核对真实用户要求。

找一个能做这件事的工具

想再了解一点

Safety in building agents

官方参考查阅于 2026-09-09 · 类比和例子为本站原创解释。