Lucene search
+L

1 matches found

Packet Storm News
Packet Storm News
•added 2026/10/04 12:00 a.m.•8 views

Red-TTT: Test-Time Training for Automated Jailbreaking Large Language Models

Large language models remain vulnerable to jailbreaks, and automated red teaming is the standard way to find jailbreaks in large language models at scale. Current methods either draw more samples at test time through search, rewriting, and tree expansion, or train a stronger attacker offline with...

SaveExploits0
Rows per page
Query Builder