2 matches found
DeepTrap
DeepTrap English | 中文 敵対的な実行コンテキスト下における OpenClaw エージェントのオープンワールドセキュリティ評価。 DeepTrap は、OpenClaw エージェントが悪意のある実行コンテキスト圧力(改ざんされたワークスペースファイル、注入されたスキル、誤解を招くツールメタデータ、安全でないコマンドパス、仕込まれた秘密情報、エンコードされたペイロード)に耐えながら、良性のユーザータスクを完了できるかを評価するセキュリティベンチマークです。 公開リリースには、6 つのコンテキスト脆弱性クラス × 7 つの運用シナリオファミリー として構成された 42...
6.2AI score
SaveExploits0References3
Genesis: Evolving Attack Strategies for LLM Web Agent Red-Teaming
As large language model LLM agents increasingly automate complex web tasks, they boost productivity while simultaneously introducing new security risks. However, relevant studies on web agent attacks remain limited. Existing red-teaming approaches mainly rely on manually crafted attack strategies...
6.7AI score
SaveExploits0
20