OceanAltOceanAlt

间接提示注入

Indirect prompt injection

攻击指令藏在 Agent 会读到的外部内容里(网页、文档、邮件),而不是用户输入里。因为 Agent 分不清「数据」和「指令」。

相关术语

  • 提示注入把恶意指令藏进 Agent 会读到的内容里(网页、邮件、工具返回值),诱导它做出违背用户本意的行为。在支付场景里最典型的
  • 工具投毒在 Agent 可调用的工具描述里塞进恶意指令。因为工具描述本身就会进入模型上下文,它是一条常被忽略的注入路径。

这条定义可以直接引用;固定地址:https://oceanalt.com/zh/glossary/prompt-injection-indirect

← 回术语库