4525 matches found
Manipulating-Web-Agents
Manipulación de agentes web autónomos basados en LLM mediante ataques de inyección indirecta de prompts Con la ubicuidad de las aplicaciones integradas con LLM, investigar los posibles riesgos de seguridad es crucial. Una de las vulnerabilidades más significativas de estos sistemas es su...
recipe-blog-encoding
recipe-blog-encoding !WARNING This project is entirely vibe-coded likely partially plagiarized from this repository and the author is a dumb-dumb who just thought the idea was funny Use SEO-gaming recipe preambles as a vehicle for encoding secret messages the prompt can really be anything though,...
Exponentiated-Gradient-Descent-LLM-Attack
Cambiar el archivo Readme. Este es un proyecto que explora el método de optimización Exponentiated Gradient Descent para producir sufijos adversariales que ataquen Modelos de Lenguaje de Gran Escala alineados. Se demuestra que el método es efectivo en el modelo de chat Llama-2 con 7 mil millones ...
clawguard
🦞 ClawGuard v3 Kit de Seguridad Empresarial para Agentes de IA - Defensa Activa Impulsada por SKILL.md Concepto Principal ¡La defensa principal de ClawGuard v3 no está en el código, sino en SKILL.md! El SKILL.md de cada módulo es en sí mismo una guía de defensa completa: Le dice al Agente cuándo...
FakeAuth
FakeAuth FakeAuth is a tool that prompts for user credentials and exfiltrates it with HTTP protocol. Inspired by following projects 1. hlldz's PICKL3 https://github.com/hlldz/pickl3 Expect dirty code and some bugs ; Installation No special requirements Usage v1.01 root@kitploit: Usage: FakeAuth.e...
ROPE
ROPE: Aplicación de Política de Origen Enrutado Código fuente de nuestro artículo: ROPE: Aplicación de Política de Origen Enrutado contra la Inyección Indirecta de Prompts por Xinhang Ma, Chaowei Xiao, William Yeoh, Ning Zhang, Yevgeniy Vorobeychik Resumen La inyección indirecta de prompts IPI...
CVE-2025-51860
CVE-2025-51860 Vulnerability description TelegAI, a web application for constructing and chatting with AI Characters, is vulnerable to Stored Cross-Site Scripting XSS in its chat component and character container component. An attacker can achieve arbitrary client-side script execution by craftin...
Adaptive_Greedy_Local_Search
Adaptive Greedy Local Search AGLS Secuestro de Prompts con Preservación Semántica: Un Ataque Adversarial de Caja Negra sobre la Optimización Automática de Prompts ICME 2026 Resumen: Los Modelos de Lenguaje de Gran Tamaño LLMs están cada vez más equipados con módulos automáticos de optimización de...
CVE-2025-64495-POC
CVE-2025-64495-POC Open WebUI vulnerable to Stored DOM XSS via prompts when 'Insert Prompt as Rich Text' is enabled resulting in ATO/RCE Summary The functionality that inserts custom prompts into the chat window is vulnerable to DOM XSS when 'Insert Prompt as Rich Text' is enabled, since the prom...
sk-cve-2026-26030-lab
CVE-2026-26030 — Filtro eval RCE en Semantic Kernel laboratorio Un laboratorio autocontenido que reproduce CVE-2026-26030 : ejecución remota de código inyectable mediante el filtro de búsqueda en el almacén de vectores en memoria de Microsoft Semantic Kernel Python, Solo laboratorio ético. Aislad...
batch_jailbreak
Repositorio oficial de Safety in Batches? Understanding and Mitigating Safety Failures in Batch Prompting Kihyun Kim, Hee-Seon Kim, Wonjun Lee, Changick Kim Korea Advanced Institute of Science and Technology KAIST Noticias 2026.09 ¡Nuestro artículo ha sido aceptado en AACL-IJCNLP 2026 Main! 🎉...
ContextHound
ContextHound Static analysis tool that scans your codebase for LLM prompt-injection and multimodal security vulnerabilities. Runs offline, no API calls required. The ContextHound ecosystem ContextHound is available across your entire development and browsing workflow:...
mythic_ornn
Mythic Ornn Generador impulsado por LLM para Agentes, Payload-Types y Perfiles C2 de Mythic. Los agentes de Mythic son tediosos de escribir a mano: cada uno reimplementa el mismo protocolo de red, el andamiaje de payload-type y la infraestructura de C2. Mythic Ornn omite el código repetitivo...
CVE-2026-78906-ChatGPT-Prompt-Injection
CVE-2026-78906 — PromptGhost API de ChatGPT — Inyección de Prompts y Exfiltración de Memoria...
claude-project-scanner
Escáner de Proyectos Claude Skill de Claude Code de solo lectura que escanea proyectos de terceros en busca de riesgos de seguridad conocidos antes de que los abras. Detecta los patrones de ataque documentados en: CVE-2025-59536 inyección de Lifecycle Hooks de Claude Code CVE-2025-61260 inyección...
rebuff
Rebuff.ai Detector de inyección de prompts con auto-endurecimiento Rebuff está diseñado para proteger aplicaciones de IA contra ataques de inyección de prompts PI mediante una defensa multicapa. Playground • Discord • Características • Instalación • Primeros pasos • Autohospedaje • Contribuciones...
agentic-dm-gateway
Agentic DM Gateway Security control plane for LLM agents over private chat typically Discord DMs. It sits in front of your agent. It decides who may talk, whether the session is unlocked, whether the process is paused, and whether this message is safe enough to forward. Your model and tools stay...
cve-2026-54316-lab
CVE-2026-54316 — Laboratorio de exfiltración de Claude Code vía WebFetch y HuggingFace Un laboratorio autocontenido y desechable que reproduce GHSA-fg94-h982-f3mm / CVE-2026-54316: Claude Code preaprobó huggingface.co como un nombre de host simple para la herramienta WebFetch, por lo que cualquie...
llm-prompt-injection-resources
llm-prompt-injection-resources Una colección seleccionada de recursos para aprender e investigar sobre ataques de inyección de prompts en LLM, defensas y seguridad. Donar Apoya el mantenimiento de este proyecto con PayPal o escaneando el código QR a continuación...
agent-scan v0.6.4-snapshot-6e2d290-1638
Snyk Agent Scan Discover and scan agent components on your machine for prompt injections and vulnerabilities including agents, MCP servers, skills. Note: We don't publish an npm package for Agent Scan. Install it via uvx or as a standalone binary. Note: CLI output is experimental and subject to...