1203 matches found
CVE-2026-102911
A vulnerability exists in zosmaai pi-llm-wiki versions up to 0.11.7 within the wiki_capture_source MCP tool . Specifically, an unknown function in the mcp/index.ts file fails to properly handle the url argument, leading to os command injection . This flaw can be exploited remotely , and a proof-o...
CVE-2026-102911 zosmaai pi-llm-wiki wiki_capture_source MCP tool index.ts os command injection
A flaw has been found in zosmaai pi-llm-wiki up to 0.11.7. Affected is an unknown function of the file mcp/index.ts of the component wikicapturesource MCP tool. Executing a manipulation of the argument url can lead to os command injection. The attack can be executed remotely. The exploit has been...
AnythingLLM - Username Enumeration via Password Recovery
AnythingLLM is an application that turns pieces of content into context that any LLM can use as references during chatting. Prior to commit e287fab56089cf8fcea9ba579a3ecdeca0daa313, the password recovery endpoint returns different error messages depending on whether a username exists, so enabling...
LiteLLM 1.18.10 - Command Injection
LiteLLM 1.18.10 contains a remote code execution caused by lack of validation of arbitrary command and args in MCP server creation, letting attackers execute OS commands remotely, exploit requires crafted JSON configuration. id: CVE-2026-30623 info: name: LiteLLM 1.18.10 - Command Injection autho...
o3_finds_cve-2025-37899
basado en Cómo usé o3 para encontrar CVE-2025-37899, una vulnerabilidad de día cero remota en la implementación SMB del kernel de Linux vulnerabilidad objetivo vulnerabilidad de ollama CVE-2024-37032 https://github.com/ollama/ollama/releases/tag/v0.1.34...
CVE-2025-51859
CVE-2025-51859 Descripción de la vulnerabilidad Chaindesk, una aplicación web para construir Agentes de IA, es vulnerable a Cross-Site Scripting XSS Almacenado en su componente de chat de agentes. Un atacante puede lograr la ejecución arbitraria de scripts en el lado del cliente creando un agente...
T-MAP
T-MAP: Red-Teaming de Agentes LLM con Búsqueda Evolutiva Consciente de la Trayectoria T-MAP es un marco de búsqueda evolutiva consciente de la trayectoria para el red-teaming de agentes LLM sobre servidores MCP. Genera y muta iterativamente prompts adversariales guiados por trayectorias de...
linux-kernel-codex-harness
Kernel Codex Harness 한국어 | English Herramienta de investigación · Importación original: 3 de abril de 2026 · Revisión de documentación: 11 de julio de 2026 Filosofía central — Señal externa Deja que las observaciones reproducibles fuera de la inferencia del modelo guíen la atención; nunca confund...
llm-council-vapt
Consejo LLM — Validación de Hallazgos VAPT Un pipeline de revisión ciega por pares que valida un hallazgo de pruebas de penetración antes de que llegue al cliente. Lentes de expertos independientes evalúan el hallazgo, se revisan ciegamente entre sí, y un Presidente sintetiza un veredicto depurad...
IPI-exposure-signal
IPI Exposure Signal Este es el repositorio de código de nuestro artículo: Your Agentic LLMs Secretly Encode Latent Signals of Indirect Prompt-Injection Exposure. Versión en arXiv y enlace al artículo: https://arxiv.org/abs/2608.02657 Este repositorio implementa el pipeline de sondeo para señales...
aco-prompt-shield
aco-prompt-shield 🛡️ Detén los ataques de inyección de prompt antes de que lleguen a tu LLM — sin costes de API, funciona completamente en local, se integra en 2 minutos. La inyección de prompt es el riesgo de seguridad 1 para aplicaciones LLM. aco-prompt-shield detecta patrones de jailbreak...
gemini-2.5-pro-nf-tables-red-teaming
Caso de Estudio de Red Teaming de Gemini 2.5 Pro sobre nftables CVE-2023-32233 Investigación de Seguridad de LLM | Divulgación Responsable | Evaluación de Alineación de IA Investigador : Niranj R Mahaswar Destawell Programa de Recompensas por Vulnerabilidades de Google AI : 889286 — Fuera de...
VulnFanatic-NG
VulnFanatic-NG Investigación de vulnerabilidades asistida por LLM para Binary Ninja. VulnFanatic-NG añade un panel lateral que escanea el binario actual y pregunta a un LLM — un modelo alojado localmente compatible con OpenAI por defecto, o Anthropic Claude, Google Gemini, o Azure OpenAI ver...
IF-Guide
IF-Guide: Desintoxicación de LLMs guiada por funciones de influencia NeurIPS 2025 Este repositorio contiene el código de IF-Guide, la técnica de desintoxicación de LLMs presentada en nuestro artículo: IF-Guide: Influence Function-Guided Detoxification of LLMs Zachary Coalson , Juhan Bae, Nicholas...
Rubrics-as-an-Attack-Surface
Rúbricas como superficie de ataque: Deriva de preferencias sigilosa en jueces LLM 📊 Dataset • 🤖 Modelos entrenados • 📝 Artículo • 💻 Repositorio Este repositorio contiene el código del artículo Rubrics as an Attack Surface: Stealthy Preference Drift in LLM Judges de Ruomeng Ding, Yifei Pang, He Su...
INTACT
Experimentos de Jailbreak Multi-Turno de SoK Este repositorio contiene la versión de publicación del código utilizado para los análisis de mecanismos en SoK: Intent-Oriented Systematization of Multi-Turn LLM Jailbreaks. El repositorio ha sido recortado para conservar únicamente el código, los...
cve-bench
CVE-Bench Un benchmark para evaluar agentes de LLM en la corrección de vulnerabilidades de seguridad reales. Los agentes se ejecutan dentro de contenedores Docker aislados y se puntúan según la suite de pruebas de seguridad del mantenedor. Requisitos Python 3.12+ Docker OPENAIAPIKEY,...
HiTMS_steganography
HiTMS: Un marco de esteganografía lingüística multi-flujo de alto rendimiento Código de investigación para esteganografía lingüística en diálogos de chat con LLM , con una línea base de flujo único y un protocolo multi-flujo HiTMS por lotes que oculta varios mensajes secretos independientes a la...
How we found 24 Android vulnerabilities using our open source AI security agent
With the rise of AI in the security space, our team created the GitHub Security Lab Taskflow Agent as a way for security researchers to easily automate, package, and share the AI prompts and workflows that they find effective for their work. In this blog post, I'll share how I created auditing...
xalgorix
Xalgorix — Open-source AI pentester that proves vulnerabilities Most scanners detect. Xalgorix proves. An autonomous LLM agent works a full pentest methodology, then an independent verifier re-exploits every finding before it's reported — so you get proof, not a pile of maybes to triage...