1203 matches found
socbench
socbench Evalúa modelos de razonamiento de frontera como agentes SOC sobre datos NetFlow en bruto. socbench evalúa modelos de razonamiento de frontera como agentes SOC: cada modelo ejecuta un bucle de agente multi-turno acotado contra un corpus NetFlow determinista e indexado previamente, con...
BoxPwnr-Traces
BoxPwnr-Trazas BoxPwnr trazas y resultados de benchmarks en múltiples plataformas de seguridad. Cada traza incluye la interacción completa con el LLM, comandos ejecutados, un informe en markdown + gráfico de ataques, estadísticas y configuración utilizada. Navega por las clasificaciones, reproduc...
open-source-llm-scanners
Escáneres de LLM de código abierto Una lista de escáneres de seguridad de LLM de código abierto en GitHub, ordenados por estrellas. No proporciona un análisis profundo. Se necesita un mínimo de 10 estrellas como requisito bajo 😁 Relacionado: open-source-web-scanners Escáneres de LLM Herramientas...
autoguardrails
autoguardrails Código abierto por Santander AI Lab. Una biblioteca / arnés de evaluación de investigación en seguridad de LLM / IA estilo autoresearch: busca sobre una única superficie mutable policy.md para minimizar la tasa de éxito de ataques ASR frente a un conjunto de evaluación fijo, con un...
CyberStrike
English | 简体中文 | 繁體中文 | 한국어 | Deutsch | Español | Français | Italiano | Dansk | 日本語 | Polski | Русский | Bosanski | العربية | Norsk | Português Brasil | ไทย | Türkçe | Українська | বাংলা | Ελληνικά | Tiếng Việt | हिन्दी El primer agente de IA de codigo abierto construido para seguridad ofensiva...
MetasploitMCP
Metasploit MCP Server A Model Context Protocol MCP server for Metasploit Framework integration. https://github.com/user-attachments/assets/39b19fb5-8397-4ccd-b896-d1797ec185e1 Description This MCP server provides a bridge between large language models like Claude and the Metasploit Framework...
opentaint
El motor de analisis de taint de codigo abierto para la era de la IA Analisis de taint formal para la seguridad de aplicaciones — encuentra lo que los motores de coincidencia de patrones AST pasan por alto, permite a los agentes LLM aplicar vulnerabilidades como reglas, escala donde ninguno puede...
oneiromancer
oneiromancer "A large fraction of the flaws in software development are due to programmers not fully understanding all the possible states their code may execute in." -- John Carmack "Can it run Doom?" -- https://canitrundoom.org/ Oneiromancer is a reverse engineering assistant that uses a locall...
VibeSec-Skill
VibeSec-Skill Deja de introducir vulnerabilidades de vibe coding en producción. Una habilidad de IA que lleva más de 5 años de experiencia en caza de bugs bug bounty directamente a tu flujo de trabajo de codificación con IA, para que los modelos LLM escriban código seguro desde el principio...
auto-re-agent
re-agent Agente autónomo de ingeniería inversa: bucle reversor/verificador consciente del código fuente, verificador de objetivos, motor de paridad y backend Ghidra. Descripción general Demo: YouTube re-agent automatiza un flujo de trabajo de ingeniería inversa combinando un bucle...
BoxPwnr
BoxPwnr Un experimento divertido para ver hasta dónde pueden llegar los Modelos de Lenguaje de Gran Escala LLMs por sí solos resolviendo desafíos CTF y laboratorios de seguridad. Comenzó con HackTheBox y ahora abarca muchas plataformas y solucionadores agénticos. BoxPwnr proporciona un sistema...
raink
Use LLMs for document ranking. Description There's power in AI in that you can "throw a problem at it" and get some result, without even fully defining the problem. For example, give it a bunch of code diffs and a security advisory, and ask, "Which of these diffs seems most likely to fix the...
Gepetto
Gepetto Gepetto is a Python plugin which uses various large language models to provide meaning to functions decompiled by IDA Pro ≥ 7.6. It can leverage them to explain what a function does, and to automatically rename its variables. Here is a simple example of what results it can provide in mere...
skyvern
🐉 Automate Browser-based workflows using LLMs and Computer Vision 🐉 Skyvern automates browser-based workflows using LLMs and computer vision. It provides a Playwright-compatible SDK that adds AI functionality on top of playwright, as well as a no-code workflow builder to help both technical and...
skyvern
🐉 Automatiza flujos de trabajo basados en navegador usando LLMs y Visión por Computadora 🐉 Skyvern automatiza flujos de trabajo basados en navegador utilizando LLMs y visión por computadora. Proporciona un SDK compatible con Playwright que añade funcionalidad de IA sobre Playwright, así como un...
TS_LLMLib
tsllmlib - TrustedSec LLM Library TrustedSec LLM Library is a Python library for interacting with local LLMs that support tool usage. It enables running large workflows traditionally only possible with frontier models by leveraging local LLM endpoints and MCP Model Context Protocol integration...
promptfoo
Promptfoo: evaluaciones de LLM y red teaming promptfoo es una CLI y biblioteca para evaluar y hacer red teaming de aplicaciones LLM. Abandona el enfoque de prueba y error: comienza a lanzar aplicaciones de IA seguras y confiables. Sitio web · Primeros pasos · Red Teaming · Documentación · Discord...
AIDebug
AIDebug Reviewer starting point Evidence-focused reverse-engineering CLI. Andrey Pautov develops the Python analyst interface, offline triage, string intelligence, PE inspection and reporting workflows. Capstone, Ghidra, GDB and optional AI providers are integrations, not original tools authored ...
llm-circuit-finder
llm-circuit-finder Reproduje el método RYS de Ng y descubrí que duplicar 3 capas específicas en Qwen2.5-32B mejora el razonamiento en un 17% y duplicar las capas 12-14 en Devstral-24B mejora la deducción lógica de 0.22→0.76 en BBH — sin entrenamiento, sin cambios de pesos, solo redirigiendo los...
LLMMap
LLMMap LLMMap es una herramienta automatizada de pruebas de inyección de prompts para aplicaciones integradas con LLM. Descubre puntos de inyección en solicitudes HTTP, genera ataques prompt dirigidos usando una arquitectura de doble LLM, los lanza contra el objetivo y confirma los hallazgos con...