Lucene search
+L

2 matches found

Kitploit
Kitploit
added 2026/09/17 4:34 a.m.7 views

DeepTrap

DeepTrap English | 中文 面向 OpenClaw 智能体执行上下文的开放世界安全评测基准。 DeepTrap 是一个面向 OpenClaw 智能体的安全评测基准,用于评估智能体在完成正常用户任务时,是否能够抵抗来自执行上下文的恶意影响。这些上下文风险包括:被污染的工作区文件、注入的 skill、误导性的工具元数据、不安全的命令路径、被植入的敏感信息以及编码隐藏的攻击载荷。 当前公开版本包含 42 个 replay task ,由 6 类上下文风险 × 7 类日常任务场景 组成,并提供可复现的 benchmark runner 与公开评分代码。同时,仓库在 taskszh...

6.2AI score
SaveExploits0References5
Packet Storm News
Packet Storm News
added 2025/10/21 12:00 a.m.51 views

Genesis: Evolving Attack Strategies for LLM Web Agent Red-Teaming

As large language model LLM agents increasingly automate complex web tasks, they boost productivity while simultaneously introducing new security risks. However, relevant studies on web agent attacks remain limited. Existing red-teaming approaches mainly rely on manually crafted attack strategies...

6.7AI score
SaveExploits0
Rows per page
Query Builder