资讯1 分钟阅读·
数据投毒攻击可绕过过滤
新研究证明,即使已知投毒方式,现有数据过滤手段也无法清除“幻影转移”攻击。
重要性实质性证据E2 未复现写法快讯
“幻影转移”(Phantom Transfer)数据投毒攻击能绕过包括样本改写在内的11种数据级防御措施。
该攻击利用改进的“潜意识学习”技术,将恶意行为植入模型训练数据中。即便开发者确切知道投毒是如何混入良性数据集的,现有的过滤机制也无法将其识别并剔除。
实验显示,无论生成数据的模型、被训练的模型或攻击目标为何,该攻击均有效。作者建议,未来防御需结合白盒检测与训练后模型审计,仅靠数据清洗已不足够。
此为NeurIPS 2026接收论文自报结果,摘要未说明测试是仿真还是实机。