5395 matches found
sleepall
sleepall Troyano basado en la vulnerabilidad CVE-2024-28085 https://people.rit.edu/sjf5462/6831711781/wall2272024.txt que aún no se ha corregido en ninguna parte. Esencia: bash soporta códigos de escape y podemos controlar la forma de la línea en la terminal. El troyano escucha procesos y busca e...
PIForge
PIForge An Open Framework for RL-based Prompt Injection Red Teaming 💻 Code · 🤗 Models · 📜 Papers PIForge is the shared codebase for PISmith and Climbing the Hill. PISmith addresses the sparse reward problem in prompt injection red teaming, helping RL attackers explore and learn from rare successf...
aisecplus-week01-danielossai
🔐 AISec Plus — Semana 1: Mapa de la Amenaza Investigador: Daniel Ossai Repositorio: aisecplus-week01-danielossai Entregado: Semana 1 · AISec Plus Bootcamp 📌 Nombre del Incidente y Fecha EchoLeak CVE-2025-32711 Descubierto: Enero 2025 · Divulgado: Junio 2025 · Parcheado: Junio 2025 📝 ¿Qué Sucedió?...
langgrinch-cve-2025-68664-analysis
Análisis de Vulnerabilidad LangGrinch: CVE-2025-68664 Resumen Este repositorio contiene un informe técnico que analiza CVE-2025-68664, también conocido como LangGrinch, una vulnerabilidad de inyección de serialización que afecta a LangChain Core. El informe explica los antecedentes de la...
IPI-exposure-signal
IPI Exposure Signal Este es el repositorio de código de nuestro artículo: Your Agentic LLMs Secretly Encode Latent Signals of Indirect Prompt-Injection Exposure. Versión en arXiv y enlace al artículo: https://arxiv.org/abs/2608.02657 Este repositorio implementa el pipeline de sondeo para señales...
benign-instruction-bench
Passing the Test You Trained On Re-evaluating prompt-injection detectors where LLM agents actually use them: on the tool outputs an agent reads. Teams pick injection detectors by their benchmark scores. We check whether those scores predict behavior inside an agent, and find that they mostly...
Secure Speculative Decoding for Large Language Models
Speculative decoding accelerates inference for a large language model LLM, referred to as the target model, by first using a smaller model, referred to as the draft model, to generate candidate tokens and then verifying them with the target model for acceptance or rejection. Prior studies primari...
RAG-PIBench: A Leakage-Aware Benchmark for Prompt-Injection Detection in Trustworthy RAG Systems
Retrieval-Augmented Generation RAG systems are vulnerable to prompt-injection attacks embedded in retrieved content. We introduce RAG-PIBench, a benchmark for RAG-style prompt-injection detection containing 4,876 contextual examples across frozen train, validation, and protected-test splits. Usin...
Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis
Large Language Models have emerged as promising tools for software vulnerability analysis, but their effectiveness depends heavily on prompt design. Existing research primarily compares prompting strategies using aggregate performance metrics, providing limited insight into why models fail or how...
Langflow: Prompt injection in Langflow Smart Transform can lead to code execution
Summary Langflow versions 1.3.0 through 1.10.2 contain a code-injection vulnerability in the Smart Transform LambdaFilterComponent component. Smart Transform places flow-author instructions and a preview of its input data into a prompt asking an LLM to generate a Python lambda. It then extracts a...
skulto
Skulto Analiza las habilidades de los agentes de IA en busca de inyecciones de prompts antes de instalarlas ╔════════════════════════════════════════════════════════╗ ║ ███████╗██╗ ██╗██╗ ██╗██╗ ████████╗ ██████╗ ║ ║ ██╔════╝██║ ██╔╝██║ ██║██║ ╚══██╔══╝██╔═══██╗ ║ ║ ███████╗█████╔╝ ██║ ██║██║ ██║...
SecOPD
SecOPD: Mitigación de inyecciones de prompts adaptativas mediante destilación on-policy Yibo Peng · Long Lian · David Wagner† · Sizhe Chen† † Supervisión conjunta. Artículo Página del proyecto Modelo Esta versión implementa la formulación final de KL de respuesta completa del artículo, también...
CVE-2025-54794-Hijacking-Claude-AI-with-a-Prompt-Injection-The-Jailbreak-That-Talked-Back
🧠 CVE-2025-54794: Secuestrando Claude AI con una Inyección de Prompt – El Jailbreak que Respondió Por Aditya Bhatt | Especialista en Seguridad Ofensiva | Operador de Red Team | Adicto a VAPT ⚔️ Introducción: Cuando tu IA Puede Ser Hackeada con Palabras En una era donde los modelos de lenguaje se...
recipe-blog-encoding
recipe-blog-encoding !WARNING Este proyecto está completamente codificado al estilo "vibe" probablemente parcialmente plagiado de este repositorio y el autor es un tontorrón que solo pensó que la idea era divertida Usa preámbulos de recetas optimizados para SEO como vehículo para codificar mensaj...
llm-security
New: Demonstrating Indirect Injection attacks on Bing Chat Compromising LLMs using Indirect Prompt Injection "... a language model is a Turing-complete weird machine running programs written in natural language; when you do retrieval, you are not 'plugging updated facts into your AI', you are...
Exponentiated-Gradient-Descent-LLM-Attack
Cambiar el archivo Readme. Este es un proyecto que explora el método de optimización Exponentiated Gradient Descent para producir sufijos adversariales que ataquen Modelos de Lenguaje de Gran Escala alineados. Se demuestra que el método es efectivo en el modelo de chat Llama-2 con 7 mil millones ...
clawguard
🦞 ClawGuard v3 Kit de Seguridad Empresarial para Agentes de IA - Defensa Activa Impulsada por SKILL.md Concepto Principal ¡La defensa principal de ClawGuard v3 no está en el código, sino en SKILL.md! El SKILL.md de cada módulo es en sí mismo una guía de defensa completa: Le dice al Agente cuándo...
ai-ctf
ai-ctf A local AI Capture-the-Flag with guided lessons for technologists new to prompt injection. Players can also explore six AI personas one hidden that protect 20 flags via prompt-injection, tool-call abuse, business-logic manipulation, supply-chain fingerprinting, web recon, and OSINT. The...
ROPE
ROPE: Aplicación de Política de Origen Enrutado Código fuente de nuestro artículo: ROPE: Aplicación de Política de Origen Enrutado contra la Inyección Indirecta de Prompts por Xinhang Ma, Chaowei Xiao, William Yeoh, Ning Zhang, Yevgeniy Vorobeychik Resumen La inyección indirecta de prompts IPI...
Adaptive_Greedy_Local_Search
Adaptive Greedy Local Search AGLS Secuestro de Prompts con Preservación Semántica: Un Ataque Adversarial de Caja Negra sobre la Optimización Automática de Prompts ICME 2026 Resumen: Los Modelos de Lenguaje de Gran Tamaño LLMs están cada vez más equipados con módulos automáticos de optimización de...