Lucene search
+L

4 matches found

Packet Storm News
Packet Storm News
added 2026/01/08 12:0 a.m.7 views

Jailbreaking Large Language Models through Iterative Tool-Disguised Attacks Via Reinforcement Learning

Large language models LLMs have demonstrated remarkable capabilities across diverse applications, however, they remain critically vulnerable to jailbreak attacks that elicit harmful responses violating human values and safety guidelines. Despite extensive research on defense mechanisms, existing...

7.3AI score
SaveExploits0
Rows per page
Query Builder