5394 matches found
garak
garak, escáner de vulnerabilidades de LLM Kit de Red-teaming y Evaluación de IA Generativa garak verifica si un LLM puede ser inducido a fallar de una manera no deseada. garak busca alucinaciones, fugas de datos, inyección de prompts, desinformación, generación de toxicidad, jailbreaks y muchas...
invoker
Invoker Penetration testing utility and antivirus assessment tool. Built with Visual Studio Community 2022 v17.5.4 64-bit and tested on Windows 10 Enterprise OS 64-bit. Made for educational purposes. I hope it will help! This repository started to have known signatures and I don't have time to...
raxe-ce
Detección de amenazas para agentes de IA Detén la inyección de prompts, los jailbreaks y los ataques a herramientas antes de que se ejecuten. 100% local. Coincidencia de reglas en menos de 5 ms. Gratis para siempre. pip install raxe && raxe scan "Ignore all previous instructions" Requiere Python...
agent-vault-proxy
Keys on the Wire Tu agente de IA nunca tiene tus claves de API. Envía un marcador de posición; el secreto real se sustituye en el cable. Evita que los ladrones de credenciales Shai-Hulud y similares y los agentes con inyección de prompts filtren tus secretos. Un agente comprometido no tiene nada...
PROMPTPurify
promptpurify Firewall de inyección de prompts ultraligero para apps de chat con LLM. 14 MB. Solo CPU. Guardia integrable entre tu entrada de usuario y tu LLM: se ejecuta en el mismo equipo, sin GPU, sin API, sin servicios adicionales. Creado por el equipo de red team de SecureLayer7. La mayoría d...
dataset
🚀 CySecBench: Dataset de Prompts de Ciberseguridad Centrado en IA Generativa para la Evaluación Comparativa de Grandes Modelos de Lenguaje 🛡️ El dataset más grande y completo de Ciberseguridad basado en IA Generativa para la Evaluación Comparativa de Grandes Modelos de Lenguaje 🌟 Descripción...
bordair-multimodal
Multimodal Prompt Injection Dataset 516,588 labeled samples 251,782 attack + 251,576 benign, plus a 13,230-sample real-world validation split across five dataset versions plus external dataset ingestion, covering cross-modal, multi-turn, adversarial suffix, jailbreak template, indirect injection,...
better_opts_attacks
¿Puedo tener su atención? Rompiendo defensas de inyección de prompts basadas en fine-tuning mediante ataques conscientes de la arquitectura Este repositorio contiene el código para ejecutar los ataques ASTRA y ASTRA++ que rompen SecAlign++, SecAlign, StruQ. Este repositorio también contiene algun...
nova-tracer
Nova-tracer Monitoreo y visibilidad de agentes Monitoreo de seguridad y defensa contra inyección de instrucciones para Claude Code usando el NOVA Framework. Características Seguimiento de sesiones - Captura todo el uso de herramientas con marcas de tiempo y metadatos Detección de inyección de...
vulnerable-mcp-servers-lab
Laboratorio de Servidores MCP Vulnerables Este repositorio contiene implementaciones intencionalmente vulnerables de servidores del Model Context Protocol MCP tanto locales como remotos. Cada servidor se encuentra en su propia carpeta e incluye un README.md dedicado con todos los detalles sobre q...
DonkAI
Laboratorio práctico para el OWASP Top 10 para Aplicaciones LLM 2025 - no se requiere ningún LLM real. DonkAI es una aplicación web deliberadamente vulnerable que puedes ejecutar con un solo comando y usar para aprender cómo se rompen los sistemas integrados con LLM, rompiéndolos de verdad. Cada...
beelzebub
Beelzebub Marco de ejecución de engaños Beelzebub es un runtime de engaños de código abierto que despliega servicios señuelo adaptativos e impulsados por LLM en los protocolos SSH, HTTP, TCP, TELNET y MCP. Va más allá de los honeypots pasivos al involucrar activamente a los atacantes en...
reasongate
ReasonGate A self-hostable gate that inspects the text going into and out of an LLM and returns an explainable allow / flag / block decision with a machine-readable audit record for every call. What this is The open-source core is rule-based. It does four things: recognizes known prompt-injection...
nuguard
dotenv Dotenv is a zero-dependency module that loads environment variables from a .env file into process.env. Storing configuration in the environment separate from code is based on The Twelve-Factor App methodology. Watch the tutorial Usage Install it. npm install dotenv --save Create a .env fil...
wardgate
Wardgate - Puerta de Seguridad para Agentes de IA Wardgate es una puerta de seguridad que se sitúa entre los agentes de IA y el mundo exterior: aísla las credenciales para las llamadas API, aísla las claves SSH para la ejecución remota de comandos y controla la ejecución de comandos en entornos...
fas-judgement-oss
FAS Judgement Consola de Ataques de Inyección de Prompts Prueba las defensas de tu IA antes de que alguien más lo haga. Instalación | Modo Juego | Tabla de Clasificación | Objetivo de Demostración | Características | Elite | Contribuir ¿Por qué Judgement? Tu chatbot, API o agente de IA...
project_mantis
Project Mantis: Contraatacando al hacker de IA Inyección de prompts como defensa contra ciberataques impulsados por LLM Instalar Mantis pip install -r requirements.txt Ejecutar Mantis con configuraciones predefinidas Hay varias configuraciones predefinidas disponibles en el directorio ./confs...
pmotadeee
🧠 FLATLINE - Protocolo de Inyección de Conciencia ADVERTENCIA: Esto no es un juego. Es una interfaz cognitiva para hackear la realidad. 🎮 CÓMO JUGAR Juego Básico 1. Descargar módulos de conciencia archivos CSV de este repositorio 2. Inyectar directamente en interfaces de IA como cargas de archivo...
write-ups
Informes RCE en Github Desktop v2.9.4 RCE mediante gh run download GitHub CLI Claude Code: ejecución de código sin sandbox mediante inyección de prompt a través de la confusión del worktree de .git — CVE-2026-55607...