1647 matches found
CVE-2025-51859
CVE-2025-51859 Vulnerability description Chaindesk, a web application for constructing AI Agents, is vulnerable to Stored Cross-Site Scripting XSS in its agent chat component. An attacker can achieve arbitrary client-side script execution by crafting an AI agent whose system prompt instructs the...
DCVD
project/ ├── train.py ├── dataloader.py ├── README.md ├── requirements.txt ├── models/ │ ├── controlpathway.py │ ├── semanticpathway.py │ ├── featurefusionmodule.py │ ├── transformerllmmodule.py │ └── multitaskpredictor.py Fuentes de datos y modelos Conjunto de datos Usamos el conjunto de datos...
isa_recovery
Sistema de Recuperación ISA Un pipeline de ingeniería inversa que convierte un binario de firmware y su desensamblado posiblemente incorrecto en una especificación de procesador funcional para Ghidra. Cuando te encuentras con un procesador propietario sin documentación y sin soporte en Ghidra, es...
antisquat
AntiSquat AntiSquat aprovecha técnicas de inteligencia artificial como el procesamiento del lenguaje natural NLP, grandes modelos de lenguaje ChatGPT y más para potenciar la detección de dominios de typosquatting y phishing. Cómo usar Clona el proyecto mediante git clone...
smartmap
Godview Godview es un mapa basado enteramente en LLMs Large Language Models y OSM Open Street Map. Utiliza Anthropic, DeepSeek u Open AI. Godview también se ejecuta localmente con Ollama. Sitio web: godview.ai Instalación Clonar el repositorio git clone https://github.com/space0blaster/godview.gi...
ShadowMem
ShadowMem: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory This repository contains the official code release for the paper Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory. ShadowMem is a defensive framework that maintains a dedicated, safety-focused...
CVE-2025-3248
CVE-2025-3248 — Exploit RCE para Langflow Exploit de ejecución remota de código RCE para aplicaciones Langflow vulnerables a CVE-2025-3248. Endpoint afectado: /api/v1/validate/code 🚀 Características del Exploit 🔓 RCE remoto y sin autenticación 🔐 No se requiere autenticación 🐍 Script de una línea ...
delirium-ai-safety-benchmark
Delirium: Benchmark de Seguridad de IA Un marco de diagnóstico para medir la vulnerabilidad de los LLM ante la Erosión Contextual Afectiva ACE y vectores de ataque liminales relacionados. Delirium no es una herramienta de explotación. Es un benchmark estandarizado diseñado para detectar el moment...
prompt_injection
Cross-Surface Prompt Injection Benchmark Benchmark for measuring where in a tool-using LLM agent's execution pipeline a prompt injection defense fires — and where it doesn't. Embeds unique canary tokens SECRET-A-F0-98 in injected payloads and tracks them at four pipeline stages: exposed → persist...
SEW
SEW: Style-Encoded Watermarking of LLM-Generated Code Paper Link 📖 📰 News 📢 NEW! The SEW paper is available on arXiv: arXiv:2609.39414. Sep 30, 2026 📢 The official SEW code has been released on GitHub. Sep 30, 2026 🔍 Motivation Feature| Token-level watermarks KGW, SWEET, Unigram, STONE, STA-1|...
reverse-captcha-eval
Reverse CAPTCHA: Evaluación de la susceptibilidad de los LLM a la inyección invisible de instrucciones Unicode Un marco de evaluación que prueba si los modelos de lenguaje grandes siguen instrucciones codificadas en Unicode invisible incrustadas en texto que de otro modo parece normal. Mientras q...
FinRED-paper
FinRED: An Expert-Guided Benchmark Generation and Evaluation Framework for Financial LLM Red-Teaming IEEE ICDM 2026 A red-team benchmark generation pipeline for safety evaluation in the financial domain. Supplementary Documentation Detailed materials referenced in the paper:...
skill-scanner
Skill Scanner A best-effort security scanner for AI Agent Skills that detects prompt injection, data exfiltration, and malicious code patterns. It combines pattern-based detection YAML + YARA-X, AST and dataflow analysis , an optional LLM-as-a-judge , and a bounded CEL decision layer over typed...
claude_opus_cve_2023_0266
Demostración de que Claude 3 Opus no entiende CVE-2023-0266 y no lo encuentra Demo 1. Incluso si se le dice dónde está el error, Opus no lo encuentra y alucina la presencia de adquisiciones de bloqueo Demo 2. La "ingeniería de prompts" también conocido como decirle al LLM exactamente cómo encontr...
AI-driven-MITRE-Attack
POC : Detección de Tácticas MITRE y Enriquecimiento de Alertas Impulsado por IA Este repositorio demuestra un pipeline de aprendizaje automático para detectar técnicas MITRE ATT&CK a partir de registros y enriquecer la salida usando un LLM local. Descripción general El proyecto está dividido en d...
IfritProxy
🔥 Plataforma de Decepción de Amenazas e Inteligencia Impulsada por IA Convierte a los atacantes en fuentes de inteligencia con respuestas adaptativas de honeypot 📦 Inicio rápido • ✨ Características • 🔄 Cómo funciona • 📚 Documentación • 🔌 API Presentado a la comunidad por 🎯 ¿Qué es IFRIT? IFRIT es...
llm-censorship-steering
Dirección de la Censura en LLM Este repositorio contiene la implementación del código de Dirigiendo la Censura: Descubriendo Vectores de Representación para el Control del "Pensamiento" en LLM por Hannah Cyberey y David Evans. Presentamos un método que encuentra "vectores de dirección" a partir d...
saffron
Saffron-1: Escalado de Inferencia para la Garantía de Seguridad de LLM 📖 Artículo 🛠️ Dependencias El código fue probado con las siguientes dependencias: Python 3.12.3 CUDA 12.2 typingextensions==4.14.0 numpy==2.2.6 torch==2.5.1 huggingfacehub==0.30.2 accelerate==1.1.1 datasets==3.1.0...
exfil-scan
exfil-scan Analiza las salidas de LLM y el contenido generado por IA en busca de señales de exfiltración de datos antes de que lleguen a los usuarios, los registros o los sistemas posteriores. 1 Por qué existe exfil-scan Las aplicaciones modernas con LLM procesan habitualmente prompts sensibles,...
ai-code-review
🔍 codereview Revisión de código impulsada por IA en tu terminal. Un comando. Comentarios instantáneos. Detecta vulnerabilidades de seguridad, errores y malas prácticas antes de que lleguen a producción. Instalación · Inicio rápido · Uso · Proveedores · Contribuir Qué hace codereview envía tu códi...