2 matches found
DeepTrap
DeepTrap English | 中文 面向 OpenClaw 智能体执行上下文的开放世界安全评测基准。 DeepTrap 是一个面向 OpenClaw 智能体的安全评测基准,用于评估智能体在完成正常用户任务时,是否能够抵抗来自执行上下文的恶意影响。这些上下文风险包括:被污染的工作区文件、注入的 skill、误导性的工具元数据、不安全的命令路径、被植入的敏感信息以及编码隐藏的攻击载荷。 当前公开版本包含 42 个 replay task ,由 6 类上下文风险 × 7 类日常任务场景 组成,并提供可复现的 benchmark runner 与公开评分代码。同时,仓库在 taskszh...
6AI score
SaveExploits0References5
20