Lucene search
+L

1 matches found

Packet Storm News
Packet Storm News
•added 2026/08/26 12:00 a.m.•45 views

NeuronFuzz: Safety Neuron Guided Fuzzing for LLM Safety Evaluation

Safety evaluation is critical for assessing whether aligned Large Language Models LLMs remain robust against jailbreak attacks. Existing automated testing methods, however, largely rely on response-level feedback: each candidate prompt typically requires generating a target-model response to...

5.9AI score
SaveExploits0
Rows per page
Query Builder