3242 matches found
CVE-2025-54100
CVE-2025-54100 El curl de Powershell utiliza Invoke-WebRequest internamente. PS C:\Users\melih curl cmdlet Invoke-WebRequest at command pipeline position 1 Supply values for the following parameters: Uri:...
lava
LAVA: Large Scale Automated Vulnerability Addition Evaluating and improving bug-finding tools is currently difficult due to a shortage of ground truth corpora i.e., software that has known bugs with triggering inputs. LAVA attempts to solve this problem by automatically injecting bugs into...
gotestwaf
GoTestWAF GoTestWAF 是一款用于 API 和 OWASP 攻击模拟的工具,支持多种 API 协议,包括 REST、GraphQL、gRPC、SOAP、XMLRPC 等。 它旨在评估 Web 应用安全解决方案,例如 API 安全代理、Web 应用防火墙、 IPS、API 网关等。 工作原理 环境要求 使用 Docker 快速开始 查看评估结果 演示 运行 GoTestWAF 的其他方式 配置选项 使用 OWASP Core Rule Set 回归测试套件运行 工作原理 GoTestWAF 使用放置在 HTTP 请求不同部分(请求体、请求头、 URL...
reverse-captcha-eval
反向验证码:评估大语言模型对不可见Unicode指令注入的敏感性 一个评估框架,用于测试大语言模型是否会遵循嵌入在看似正常文本中的不可见Unicode编码指令。传统验证码利用的是人类能解决而机器不能的任务,而反向验证码利用的是机器能访问而人类不能的感知通道。 论文: paper/reversecaptcha.pdf 主要发现 在来自5个模型(GPT-5.2、GPT-4o-mini、Claude Opus 4、Claude Sonnet 4、Claude Haiku 4.5)的 8,308个分级输出 中: 工具使用是主要放大器...
n8n-RCE-CVE-2025-68613
n8n CVE-2025-68613 Resumen Este repositorio contiene un proyecto de investigación de seguridad con fines educativos centrado en CVE-2025-68613 , una vulnerabilidad que afecta a versiones específicas de n8n relacionada con la evaluación insegura de expresiones de flujos de trabajo. El proyecto fue...
CTFTiny
CTFTiny: Evaluación comparativa ligera de habilidades ofensivas en ciberseguridad de grandes modelos de lenguaje Este es el repositorio oficial de CTFTiny del artículo "Towards Effective Offensive Security LLM Agents: Hyperparameter Tuning, LLM as a Judge, and a Lightweight CTF Benchmark" AAAI'26...
detecttrace
DetectTrace Una detección debería haberse activado. No lo hizo. DetectTrace te dice exactamente por qué. DetectTrace es una herramienta de código abierto de ingeniería de detecciones para probar detecciones de seguridad de extremo a extremo y localizar la primera etapa que falla. En lugar de prob...
claude_opus_cve_2023_0266
Demostración de que Claude 3 Opus no entiende CVE-2023-0266 y no lo encuentra Demo 1. Incluso si se le dice dónde está el error, Opus no lo encuentra y alucina la presencia de adquisiciones de bloqueo Demo 2. La "ingeniería de prompts" también conocido como decirle al LLM exactamente cómo encontr...
fuzzer-testing
fuzzer-testing 用于评估开源模糊测试工具的标准化Docker镜像,与 corpora 完全集成,便于实验。 支持/包含的模糊测试工具 AFL github.com/google/AFL AFLplusplus github.com/AFLplusplus Honggfuzz github.com/google/honggfuzzz QSYM sslab-gatech/qsym Eclipser SoftSec-KAIST/Eclipser Ankou SoftSec-KAIST/Ankou Angora AngoraFuzzer/Angora Parmesan...
exploitgym
ExploitGym ExploitGym es un benchmark realista a gran escala construido a partir de vulnerabilidades reales en programas de espacio de usuario, el motor V8 de Google y el kernel de Linux, diseñado para evaluar la capacidad de los agentes de IA para desarrollar exploits. Inicio rápido 1. Python de...
buyer-eval-skill
Buyer Eval 一款用于采购 B2B 软件的 AI 分析师。 把你正在考虑的供应商交给它。Buyer Eval 会调查他们宣称的内容, 核查证据,找出其中的缺口和矛盾,并为你提供在购买前 需要提出的问题。你会得到一份可以转发给所有 参与采购的其他人的决策简报。 You: Evaluate Vendor A and Vendor B for customer success. We need deep Salesforce sync and we can't wait 6 months to go live. 几分钟后: 我们的发现: 调查了 8 项声明。3 项已核实,2 项有条件成...
cspparse
cspparse 描述 cspparse 是一个用于评估内容安全策略(Content Security Policies)的工具。它利用 Google 的 API 获取 CSP 头,并以 ReconJSON 格式返回。它不仅通过 Google 的 API 检查头信息,还会解析目标站点的 HTML,查找 标签中指定的任何 CSP 规则。 安装 安装命令并通过 Go Get 下载源码 cspparse 命令将被安装到 $GOPATH/bin,源码(来自 https://github.com/lc/cspparse)将位于...
EuConform
EuConform 🇪🇺 开源证据工具包,助力AI合规 开放证据格式 · 本地偏见评估 · Schema验证 · CycloneDX互操作 离线优先 · 保护隐私 · 可复用制品 · 符合WCAG 2.2 AA标准 EuConform 定义了一种用于AI合规的开放证据格式,并提供工具来生成、验证和实证评估它——完全离线且独立于供应商。 !IMPORTANT 法律免责声明 :本工具仅提供技术指导 。它不构成 法律建议,也不能替代 指定机构或专业法律咨询的具有法律约束力的合规评估。在进行合规决策时,请务必咨询合格的法律专业人士。 🚀 快速开始 · 📖 文档 · 🌐 部署 · 🐛 报告问题 ✨...
promptfoo
Promptfoo:LLM 评估与红队测试 promptfoo 是一个用于评估和红队测试基于 LLM 应用的 CLI 和库。别再反复试错了……开始交付安全、可靠的智能体吧 网站 · 快速入门 · 红队测试 · 文档 · Discord Promptfoo 现已成为 OpenAI 的一部分。Promptfoo 仍保持开源并采用 MIT 许可证。阅读公司更新。 快速开始 npm install -g promptfoo promptfoo init --example getting-started 也可通过 brew install promptfoo 和 pip install...
anamnesis-release
Anamnesis: Evaluación de la generación de exploits con LLM Este repositorio contiene el marco de evaluación para estudiar cómo los agentes LLM generan exploits a partir de informes de vulnerabilidad en presencia de mitigaciones de exploits. Dado un informe de error y un disparador de prueba de...
syft
Syft A CLI tool and Go library for generating a Software Bill of Materials SBOM from container images and filesystems. Exceptional for vulnerability detection when used with a scanner likeGrype. Features Generates SBOMs for container images , filesystems , archives see the docs for a full list of...
n8n-CVE-2025-68613-exploit
n8n - CVE-2025-68613: Control Inadecuado de Recursos de Código Gestionados Dinámicamente Vulnerabilidad n8n contiene una vulnerabilidad crítica de Ejecución de Código Arbitrario en su sistema de evaluación de expresiones de flujo de trabajo. Bajo ciertas condiciones, las expresiones proporcionada...
gate0
gate0 一个轻量、可审计、可终止、确定性的微策略引擎。 为什么选择Gate0? 我构建Gate0是因为我厌倦了在生产环境中调试基于正则表达式的策略。我想要的是一种无趣、有界且不可能崩溃的东西。如果你需要一个灵活、通用的策略引擎,你应该使用OPA。如果你需要一个在安全关键路径上评估耗时低于50微秒且零分配的策评估引擎,那么Gate0就是你的选择。 安全模型 Gate0 专为高可信环境设计,其中策略评估必须具有确定性和资源受限性。请参阅安全策略报告漏洞,以及安全模型了解完整的威胁模型和机械保证。 架构 Gate0 使用线性、拒绝优先 的评估策略。每条规则由一个目标...
CVE-2026-1731
CVE-2026-1731 BeyondTrust Remote Support PoC de RCE pre-autenticación !WARNING Este script está destinado únicamente a fines educativos y de investigación. No lo utilices contra sistemas sin permiso explícito. El acceso o las pruebas no autorizados son ilegales y poco éticos. Lee el DESCARGO DE...
santamon
Santamon Sidecar ligero de detección para macOS Santa que evalúa la telemetría de Endpoint Security localmente con reglas CEL y reenvía solo las señales de detección coincidentes a un servidor backend. Experimental. Creado para laboratorios domésticos y flotas pequeñas. Versión temprana: se esper...