让模型按权限高低处理冲突指令的规则。
指令层级像武侠门规:掌门戒律压过师兄吩咐,路边小弟别想改秘籍。
它让机器人分清谁更有权,常用于防提示注入。
System prompt它通常位于指令层级顶部,约束后续对话。
Prompt injection它让低权限文本难以覆盖高权限规则。
Agent Security它给代理设清楚指挥链,减少越权行动。