Lucene search
+L

1 matches found

Packet Storm News
Packet Storm News
•added 2026/10/06 12:00 a.m.•7 views

The Model Plants the Trigger: Answer-Side Backdoor Attacks in Multi-Turn Large Language Models

Safety alignment in Large Language Models LLMs remains vulnerable to backdoor attacks. Existing LLM backdoors are almost all input-centric: activation depends on explicit trigger patterns in the user input, so modern guardrails are built to sanitize the input space. We challenge this assumption...

5.9AI score
SaveExploits0
Rows per page
Query Builder