3227 matches found
CVE-2026-42533
CVE-2026-42533 — nginx map/regex capture clobbering tracking site Source for the CVE-2026-42533 patch-status tracker: a single-page site recording which distributions have shipped a fix for the nginx map/regex capture-clobbering heap overflow. Where the facts live Everything about the bug —...
fuzzbench
FuzzBench: Evaluación Comparativa de Fuzzers como Servicio FuzzBench es un servicio gratuito que evalúa fuzzers en una amplia variedad de referencias del mundo real, a escala de Google. El objetivo de FuzzBench es facilitar la evaluación rigurosa de la investigación en fuzzing y hacer que dicha...
CVE-2026-1731
CVE-2026-1731 BeyondTrust Remote Support PoC de RCE pre-autenticación !WARNING Este script está destinado únicamente a fines educativos y de investigación. No lo utilices contra sistemas sin permiso explícito. El acceso o las pruebas no autorizados son ilegales y poco éticos. Lee el DESCARGO DE...
CTFTiny
CTFTiny: Evaluación comparativa ligera de habilidades ofensivas en ciberseguridad de grandes modelos de lenguaje Este es el repositorio oficial de CTFTiny del artículo "Towards Effective Offensive Security LLM Agents: Hyperparameter Tuning, LLM as a Judge, and a Lightweight CTF Benchmark" AAAI'26...
CVE-2025-54100
CVE-2025-54100 El curl de Powershell utiliza Invoke-WebRequest internamente. PS C:\Users\melih curl cmdlet Invoke-WebRequest at command pipeline position 1 Supply values for the following parameters: Uri:...
gate0
gate0 Un pequeño motor de micropolíticas auditable, terminante, determinista. ¿Por qué Gate0? Construí Gate0 porque estaba harto de depurar políticas basadas en RegEx en producción. Quería algo que fuera aburrido, acotado e imposible de bloquear. Si necesitas un motor de políticas flexible y de...
vbSparkle
¿Qué es vbSparkle? vbSparkle es un desofuscador de Visual Basic multiplataforma, de fuente a fuente, basado en evaluación parcial y dedicado principalmente al análisis de código malicioso escrito en VBScript y VBA Macro de Office. Está escrito en C nativo y proporciona una biblioteca .Net Standar...
fuzzer-testing
fuzzer-testing Imágenes Docker estandarizadas para evaluar fuzzers de código abierto, completamente integradas con los corpora para una fácil experimentación. Fuzzers compatibles / incluidos AFL github.com/google/AFL AFLplusplus github.com/AFLplusplus Honggfuzz github.com/google/honggfuzzz QSYM...
MalEval
MalEval Artículo: ¿Es “saber que es malicioso” suficiente? Evaluación de LLMs para la auditoría detallada del comportamiento de malware DOI del artículo: 10.1145/3832187 MalEval es un marco para evaluar informes de comportamiento de malware Android generados por grandes modelos de lenguaje. El...
buyer-eval-skill
Buyer Eval Un analista de IA para comprar software B2B. Dale los proveedores que estás considerando. Buyer Eval investiga lo que afirman, verifica la evidencia, encuentra los vacíos y contradicciones, y te da las preguntas que debes hacer antes de comprar. Obtienes un Decision Brief que puedes...
anamnesis-release
Anamnesis: Evaluación de la generación de exploits con LLM Este repositorio contiene el marco de evaluación para estudiar cómo los agentes LLM generan exploits a partir de informes de vulnerabilidad en presencia de mitigaciones de exploits. Dado un informe de error y un disparador de prueba de...
EuConform
EuConform 🇪🇺 Open-Source Evidence Toolkit For AI Compliance Open evidence format • Local bias evaluation • Schema validation • CycloneDX interoperability Offline-first • Privacy-preserving • Reusable artifacts • WCAG 2.2 AA accessible EuConform defines an open evidence format for AI compliance and...
claude_opus_cve_2023_0266
Demostración de que Claude 3 Opus no entiende CVE-2023-0266 y no lo encuentra Demo 1. Incluso si se le dice dónde está el error, Opus no lo encuentra y alucina la presencia de adquisiciones de bloqueo Demo 2. La "ingeniería de prompts" también conocido como decirle al LLM exactamente cómo encontr...
cspparse
cspparse Descripción cspparse es una herramienta para evaluar Políticas de Seguridad de Contenido. Utiliza la API de Google para recuperar las cabeceras CSP y las devuelve en formato ReconJSON. No solo comprueba las cabeceras con la API de Google, sino que también analiza el HTML del sitio objeti...
n8n-CVE-2025-68613-exploit
n8n - CVE-2025-68613: Control Inadecuado de Recursos de Código Gestionados Dinámicamente Vulnerabilidad n8n contiene una vulnerabilidad crítica de Ejecución de Código Arbitrario en su sistema de evaluación de expresiones de flujo de trabajo. Bajo ciertas condiciones, las expresiones proporcionada...
reverse-captcha-eval
Reverse CAPTCHA: Evaluación de la susceptibilidad de los LLM a la inyección invisible de instrucciones Unicode Un marco de evaluación que prueba si los modelos de lenguaje grandes siguen instrucciones codificadas en Unicode invisible incrustadas en texto que de otro modo parece normal. Mientras q...
DELTA
DELTA: SDN SECURITY EVALUATION FRAMEWORK We now manage DELTA in new repository https://github.com/seungsoo-lee/DELTA. Please visit our new repository and hope you see there again. Thank you! Best Regards, -- DELTA Team...
exploitgym
ExploitGym ExploitGym es un benchmark realista a gran escala construido a partir de vulnerabilidades reales en programas de espacio de usuario, el motor V8 de Google y el kernel de Linux, diseñado para evaluar la capacidad de los agentes de IA para desarrollar exploits. Inicio rápido 1. Python de...
syft
Syft A CLI tool and Go library for generating a Software Bill of Materials SBOM from container images and filesystems. Exceptional for vulnerability detection when used with a scanner likeGrype. Features Generates SBOMs for container images , filesystems , archives see the docs for a full list of...
sniffles
Sniffles--Generador de Capturas de Paquetes para IDS y Evaluación de Expresiones Regulares Sniffles es una herramienta para crear capturas de paquetes que probarán IDS que usan patrones fijos o expresiones regulares para detectar comportamientos sospechosos. Sniffles funciona de manera muy simple...