Lucene search
+L

2 matches found

Packet Storm News
Packet Storm News
added 2025/08/03 12:0 a.m.10 views

DUP: Detection-Guided Unlearning for Backdoor Purification in Language Models

As backdoor attacks become more stealthy and robust, they reveal critical weaknesses in current defense strategies: detection methods often rely on coarse-grained feature statistics, and purification methods typically require full retraining or additional clean models. To address these challenges...

7.2AI score
SaveExploits0
Rows per page
Query Builder