通过污染 AI 可引用来源来误导其输出的攻击。
来源投毒,是给 AI 的购物评价区刷满假晒单:它查得越勤,越可能把软广当真相推荐。
会污染搜索和知识库问答,诱导错误结论或恶意操作。
RAG来源投毒会让恶意内容被 RAG 检索进回答上下文。
Content provenance内容来源溯证可帮助识别被伪造或篡改的资料。
Prompt injection恶意网页可借投毒内容,同时向模型注入隐藏指令。