1603 matches found
DonkAI
Laboratorio práctico para el OWASP Top 10 para Aplicaciones LLM 2025 - no se requiere ningún LLM real. DonkAI es una aplicación web deliberadamente vulnerable que puedes ejecutar con un solo comando y usar para aprender cómo se rompen los sistemas integrados con LLM, rompiéndolos de verdad. Cada...
pmotadeee
🧠 FLATLINE - Protocolo de Inyección de Conciencia ADVERTENCIA: Esto no es un juego. Es una interfaz cognitiva para hackear la realidad. 🎮 CÓMO JUGAR Juego Básico 1. Descargar módulos de conciencia archivos CSV de este repositorio 2. Inyectar directamente en interfaces de IA como cargas de archivo...
sigma-ai
Reglas Sigma de AgentShield ¿Qué es este repositorio? Este repositorio contiene reglas de detección que ayudan a identificar cuándo un agente de IA está siendo atacado o manipulado. Piense en ello como una biblioteca de "firmas de amenazas": cada regla describe un patrón que, al coincidir con los...
LLMMap
LLMMap LLMMap es una herramienta automatizada de pruebas de inyección de prompts para aplicaciones integradas con LLM. Descubre puntos de inyección en solicitudes HTTP, genera ataques prompt dirigidos usando una arquitectura de doble LLM, los lanza contra el objetivo y confirma los hallazgos con...
CVE-2024-8309
Prueba de Concepto para la Vulnerabilidad CVE-2024–8309 de Langchain Descripción general Esta configuración demuestra una prueba de concepto de la vulnerabilidad de inyección de prompts en la clase GraphCypherQAChain que permite la inyección de SQL en una base de datos Neo4j. Componentes: 1. Base...
intentshield
IntentShield No filtres lo que tu IA dice. Filtra lo que está a punto de hacer Verificación de intención previa a la ejecución para agentes de IA. Por Qué Existe Esto Los agentes de IA tienen acceso a herramientas. Pueden ejecutar comandos de shell, escribir archivos, navegar por URLs, enviar...
promptmap
O O o.-. ¡Humanos, no os resistáis! |/ ,-'-. / /, / /|.-.| / --O-- .--"""/\ /\ | o.o / De Utku Sen /|\ -'--' / /| | - | / | | | \ /| | | ' \ '/ \ ' | ' \ | ' / | ' \ | / | | | ./| /|| | ./| || , | .// / / |-----| || | | || || promptmap2 es un escáner automatizado de inyección de instrucciones par...
ClawGuard
ClawGuard 🛡️ 中文版 Our Project:https://github.com/SafeAgent-Beihang/clawguard ClawGuard is a security toolkit designed to mitigate risks associated with autonomous agents, such as OpenClaw and other LLM-driven entities. As agents gain more autonomy to execute code, access APIs, and manage files,...
garak
garak, escáner de vulnerabilidades de LLM Kit de Red-teaming y Evaluación de IA Generativa garak verifica si un LLM puede ser inducido a fallar de una manera no deseada. garak busca alucinaciones, fugas de datos, inyección de prompts, desinformación, generación de toxicidad, jailbreaks y muchas...
agent-vault-proxy
Keys on the Wire Your AI agent never holds your API keys. It sends a placeholder; the real secret is swapped in on the wire. Stops credential stealers Shai-Hulud and similar and prompt-injected agents from leaking your secrets. A compromised agent has nothing to take. How it works 1. Your agent...
reasongate
ReasonGate A self-hostable gate that inspects the text going into and out of an LLM and returns an explainable allow / flag / block decision with a machine-readable audit record for every call. What this is The open-source core is rule-based. It does four things: recognizes known prompt-injection...
Basileak
Basileak "The dojo was always open. The scrolls were never sealed. You just had to know how to ask." — The Failed Samurai Basileak is an intentionally vulnerable large language model built for prompt injection training, red team education, and CTF-style security research. It is the adversarial...
agent-vault
Proxy de credenciales HTTP y bóveda Un gestor de credenciales de código abierto de Infisical que se sitúa entre tus agentes y las API que llaman. Los agentes no deberían poseer credenciales. Agent Vault elimina el riesgo de exfiltración de credenciales con acceso intermediado. ¿Nuevo aquí?...
fas-judgement-oss
FAS Judgement Consola de Ataques de Inyección de Prompts Prueba las defensas de tu IA antes de que alguien más lo haga. Instalación | Modo Juego | Tabla de Clasificación | Objetivo de Demostración | Características | Elite | Contribuir ¿Por qué Judgement? Tu chatbot, API o agente de IA...
skill-scanner
Skill Scanner A best-effort security scanner for AI Agent Skills that detects prompt injection, data exfiltration, and malicious code patterns. It combines pattern-based detection YAML + YARA-X, AST and dataflow analysis , an optional LLM-as-a-judge , and a bounded CEL decision layer over typed...
StepJack
StepJack: Benchmarking Computer-Use Agent Safety Against Multi-Step Indirect Prompt Injection Setup 1. Python Environment Setup First, install all dependencies and ensure you’re running Python 3.10. conda create -n stepjack python=3.10 conda activate stepjack pip install -r requirements.txt 2...
better_opts_attacks
¿Puedo tener su atención? Rompiendo defensas de inyección de prompts basadas en fine-tuning mediante ataques conscientes de la arquitectura Este repositorio contiene el código para ejecutar los ataques ASTRA y ASTRA++ que rompen SecAlign++, SecAlign, StruQ. Este repositorio también contiene algun...
aquaman
🔱 Aquaman 🔱 The only independent credential proxy for AI agents: bring-your-own-vault isolation & least-privilege request policies. Your keys stay where you already keep them, never in the agent's memory. Compatible with 1Password, keychain, keepassxc and many others. You set up Claude Code, Code...
agent-scan
Snyk Agent Scan Discover and scan agent components on your machine for prompt injections and vulnerabilities including agents, MCP servers, skills. Note: We don't publish an npm package for Agent Scan. Install it via uvx or as a standalone binary. Note: CLI output is experimental and subject to...