AI Rookies

AI Source Poisoning — AI 来源投毒

事实

通过污染 AI 可引用来源来误导其输出的攻击。

人话

来源投毒,是给 AI 的购物评价区刷满假晒单:它查得越勤,越可能把软广当真相推荐。

会污染搜索和知识库问答,诱导错误结论或恶意操作。

相关概念

RAG
来源投毒会让恶意内容被 RAG 检索进回答上下文。

Content provenance
内容来源溯证可帮助识别被伪造或篡改的资料。

Prompt injection
恶意网页可借投毒内容,同时向模型注入隐藏指令。