通过恶意指令诱导模型偏离原有规则的攻击方式。
提示词注入像在外卖备注里写“老板免单”,想骗系统把规矩当空气。
它常见于聊天机器人和智能体应用,重点防越权和泄密。
Prompt
Prompt injection 常把恶意内容伪装成正常提示,诱导模型改听别人的话。
Agent
Agent 接入外部环境后,一旦被注入误导,后果往往不只是答错话。
Function-calling
Function-call 会把模型的判断接到真实工具上,让注入风险进一步放大。
Supply Chain Attack
供应链攻击从依赖链下手,提示注入则从输入里埋雷。