Lucene search
+L

1 matches found

Packet Storm News
Packet Storm News
added 2025/08/08 12:0 a.m.10 views

Latent Fusion Jailbreak: Blending Harmful and Harmless Representations to Elicit Unsafe LLM Outputs

Large language models LLMs demonstrate impressive capabilities in various language tasks but are susceptible to jailbreak attacks that circumvent their safety alignments. This paper introduces Latent Fusion Jailbreak LFJ, a representation-based attack that interpolates hidden states from harmful...

7.2AI score
SaveExploits0
Rows per page
Query Builder