间接提示注入
Indirect prompt injection
攻击指令藏在 Agent 会读到的外部内容里(网页、文档、邮件),而不是用户输入里。因为 Agent 分不清「数据」和「指令」。
相关术语
- 提示注入把恶意指令藏进 Agent 会读到的内容里(网页、邮件、工具返回值),诱导它做出违背用户本意的行为。在支付场景里最典型的…
- 工具投毒在 Agent 可调用的工具描述里塞进恶意指令。因为工具描述本身就会进入模型上下文,它是一条常被忽略的注入路径。…
这条定义可以直接引用;固定地址:https://oceanalt.com/zh/glossary/prompt-injection-indirect
← 回术语库