Lucene search
+L

2 matches found

Packet Storm News
Packet Storm News
•added 2026/08/31 12:00 a.m.•10 views

Hidden Threat in Synthetic Data: Covert Targeted Bias Injection through Benign Text

Synthetic data is increasingly used to train large language models LLMs, yet its security implications remain poorly understood. Prior work on subliminal learning suggests that models can inherit behavioral traits from seemingly unrelated training data. In this work, we investigate whether such...

5.9AI score
SaveExploits0
Schneier on Security
Schneier on Security
•added 2025/07/25 11:10 a.m.•14 views

Subliminal Learning in AIs

Today's freaky LLM behavior: We study subliminal learning, a surprising phenomenon where language models learn traits from model-generated data that is semantically unrelated to those traits. For example, a "student" model learns to prefer owls when trained on sequences of numbers generated by a...

7.3AI score
SaveExploits0
Rows per page
Query Builder