間接提示注入
Indirect prompt injection
攻擊指令藏在 Agent 會讀到的外部內容裡(網頁、文檔、郵件),而不是用戶輸入裡。因為 Agent 分不清「數據」和「指令」。
相關術語
- 提示注入把惡意指令藏進 Agent 會讀到的內容裡(網頁、郵件、工具返回值),誘導它做出違背用戶本意的行為。在支付場景裡最典型的…
- 工具投毒在 Agent 可調用的工具描述裡塞進惡意指令。因為工具描述本身就會進入模型上下文,它是一條常被忽略的注入路徑。…
這條定義可以直接引用;固定地址:https://oceanalt.com/zh/glossary/prompt-injection-indirect
← 回術語庫