1 matches found
Defenses-for-Tool-Integrated-LLM
面向工具集成式 LLM 智能体的通用防御:抵御对抗性攻击 本仓库包含我们项目的代码与实验,该项目旨在防御工具集成式大型语言模型(LLM)智能体免受对抗性攻击。 概述 我们基于 Agent Security Bench(ASB)构建,评估集成工具与结构化推理(例如思维链、反思)如何影响 LLM 智能体在多种任务场景下对对抗性提示的脆弱性。 本仓库包含: 新的防御策略(例如基于工具的过滤、CoT+Reflection) 改编自 ASB 的攻击场景 实验脚本 基于 Agent Security Bench(ASB) 本项目改编并扩展 了官方 ASB 仓库的代码: Agent Security...
6.2AI score
SaveExploits0References1
20