AI Rookies

Agent Security — AI 代理安全

事实

保护代理执行任务时不被诱导、滥用或越权。

人话

像给能自己跑腿的打工人上工牌、开权限、盯流程;不然别人一忽悠,它真敢替你乱签字。

常用于电脑操作、联网调用和企业自动化,重点防越权与误执行。

相关概念

Agent
代理越能自主做事,安全问题就越关键。

Prompt Injection
提示词注入会把它带偏,诱导泄密或越权。

Computer Use
一旦能操作电脑,误点误发的后果更直接。

Human-in-the-loop
高风险任务常靠人工审批做最后保险。