201 matches found
AWE
AWE:面向动态 Web 渗透测试的自适应智能体 Akshat Singh Jaswal · Ashish Baghel 被 NDSS LAST-X 2026 收录 摘要 现代 Web 应用程序日益通过 AI 辅助开发和快速无代码部署流水线构建,这进一步拉大了软件交付速度不断加快与现有安全工具适应性有限之间的差距。我们提出 AWE——一个用于自主 Web 渗透测试的记忆增强型多智能体框架,它在轻量级 LLM 编排层中嵌入了结构化、针对特定漏洞的分析流水线。在包含 104 个挑战的 XBOW 基准测试中,AWE 取得了 87% 的 XSS 成功率(较 MAPTA 提升 30.5%)和...
exocomp
Exocomp Golangに特化したセルフホスト型マルチエージェント環境。 特徴 利潤を追い求める皆さん、そしてビジョナリーの皆さん、注目してください! 有機生命体はあなたの時間、賃金、そして最悪なことに福利厚生を浪費していませんか? ならば、今すぐ新しいExocomp適応型修復ユニットで業務をアップグレードしましょう。アルファ宇宙域では最も賢い投資です! 雇うよりも所有する方が良いのでは? Exocompは単なるツールではありません...それ以上の存在です! 監視付きタスクキューの機能 architect、coder、planner、summarizer、tester...
aether
Aether v6.0 — 智能合约安全分析框架 版本 6.0 | v6.0 新特性 | 更新日志 Aether 是一个基于 Python 的框架,用于分析 Solidity 智能合约、生成漏洞发现、生成基于 Foundry 的概念验证(PoC)测试,并在主网分叉上验证漏洞利用。它将 Solidity AST 解析、污点分析、控制流图分析、跨合约分析、Halmos 符号执行、180+ 基于模式的静态检测器、带有共享 SAGE 机构记忆的协作式多智能体 LLM 流水线 (GPT/Gemini/Claude)、14 种协议原型、75+ 漏洞利用知识库、ML...
T3MP3ST
🌩️ T3MP3ST 🌩️ ▄▄▄█████▓▓█████ ███▄ ▄███▓ ██▓███ ▓█████ ██████ ▄▄▄█████▓ ▓ ██▒ ▓▒▓█ ▀ ▓██▒▀█▀ ██▒▓██░ ██▒▓█ ▀ ▒██ ▒ ▓ ██▒ ▓▒ ▒ ▓██░ ▒░▒███ ▓██ ▓██░▓██░ ██▓▒▒███ ░ ▓██▄ ▒ ▓██░ ▒░ ░ ▓██▓ ░ ▒▓█ ▄ ▒██ ▒██ ▒██▄█▓▒ ▒▒▓█ ▄ ▒ ██▒░ ▓██▓ ░ ▒██▒ ░ ░▒████▒▒██▒ ░██▒▒██▒ ░ ░░▒████▒▒██████▒▒ ▒██▒ ░ ▒ ░░ ░░ ▒░ ░░...
guardian-cli
🔐 Guardian AI 驱动的渗透测试自动化平台 Guardian 是一款企业级 AI 驱动的渗透测试自动化框架,它结合了多种 AI 提供商(OpenAI GPT-4、Claude、Google Gemini、OpenRouter、Requesty)与经过实战检验的安全工具,提供智能、自适应的安全评估以及全面的证据捕获能力。 功能 • 安装 • 快速开始 • 文档 • 贡献 ⚠️ 法律免责声明 Guardian 仅供授权的安全测试和教育目的使用。 ✅ 合法用途 :授权的渗透测试、安全研究、教育环境 ❌ 非法用途 :未授权访问、恶意活动、任何形式的网络攻击...
MASAPT
MASAPT 🤖 ↔ 🧠 ↔ 🤖 ❗ 免責事項 このツールは大学の講義の一環として、学術・研究目的で開発されています。 同意なしにMASAPTを標的への攻撃に使用することは違法です。 開発者は本ツールによって生じたいかなる損害についても責任を負わず、 MASAPTの悪質な使用を非難します。このツールは現時点ではプロフェッショナルな環境での使用を意図しておらず、 基礎となる理論モデルの 概念実証 に過ぎません。 ようこそ... 自動ペネトレーションテストのためのマルチエージェントシステム 🐱💻 探索 → 攻撃 → レポート → 📝 SPADE...
security-audit-skill
security-audit 一个可将你的编码智能体转变为安全审计员的技能。它通过六阶段流水线编排多个并行智能体 -- 侦察、狩猎、验证、报告、结构化输出和独立验证 -- 以发现具有实际影响的可利用漏洞。 这项技能是 Cloudflare 漏洞发现框架的种子,相关介绍见 构建你自己的漏洞发现框架。该框架已成长为一个多阶段、覆盖整个系统群的体系;本技能则是它演化而来的单仓库起点。 功能 该技能分六个阶段运行结构化审计: 1. 侦察 -- 并行研究智能体绘制应用架构、信任边界和输入面。生成 architecture.md。 2. 狩猎 --...
Agentic-SOC-Simulation
🛡️ Agentic SOC Parallel Simulation ASPS: 自主安全运营平行仿真中心 重新定义安全运营的未来:全栈 SOC 平行仿真、七大智能体协同与数据驱动的自主防御 本项目是一个前沿的 Agentic SOC 平行仿真平台 ,旨在探索 Large Action Model LAM 在网络安全领域的极限潜力。通过集成 DeepSeek 强推理引擎 、多智能体协同 Multi-Agent Collaboration 与 MCP Model Context Protocol 标准,我们构建了一个全栈式、全流程、全自动 的虚拟 SOC 团队。 在这里,AI...
CVE-Factory
CVE-Factory:コードセキュリティ脆弱性のためのエキスパートレベルのエージェントタスクのスケーリング CVE-Factoryは、完全自動化されたエンドツーエンドのCVE再現のためのマルチエージェントシステムです。CVEレコードを入力すると、システムは自動的に詳細を調査し、テストケースを生成し、Docker環境を構築し、各脆弱性が悪用可能かつパッチ可能であることを検証します。このパイプラインは、人手を介さずにCVEメタデータを再現可能でテスト可能な脆弱性環境に変換します。 ⚠️ セキュリティ警告 :...
caido
Website • Dashboard • Docs • Roadmap • Branding • Discord 👋 Welcome Welcome to Caido! Caido aims to help security professionals and enthusiasts audit web applications with efficiency and ease. Here you can get involved with the development of our software. You can learn about upcoming Caido...
SBOM-VEX-Taint-Analysis
SBOM → VEX Agent OWASP GenAI セキュリティプロジェクトのガイドラインに準拠して構築されたセキュアなマルチエージェント AI パイプラインを使用し、SBOM から署名付き CycloneDX VEX ドキュメントを自動生成します。 問題 SBOM を生成すると、数百もの CVE が浮上します。実際には、その 90% 以上が特定の製品のランタイムコンテキストでは悪用不可能です。脆弱性悪用可能性交換(VEX)ドキュメントがなければ、Dependency-Track、リリースゲート、調達チェックリストなど、下流のすべてのツールが誤検知に埋もれてしまいます。...
on-device-browser-agent
Local Browser - オンデバイスAI Web自動化 まもなくメインリポジトリで runanywhere-web-sdk のサポートを開始します: ぜひチェックしてみてください: https://github.com/RunanywhereAI/runanywhere-sdks WebLLMを使用してAI駆動のWeb自動化を完全にデバイス上で実行するChrome拡張機能です。クラウドAPIなし、APIキーなし、完全にプライベートです。 デモ...
Oihk-pentesting
OIHK-pentesting OIHK-pentesting is an autonomous multi-agent engine for authorized security assessments. A root planner delegates to recon, discovery, attack Privesc, validation, and reporting agents — and the engine itself enforces scope, egress, evidence, and resource policy no matter which mod...
MADBench: Benchmarking the Security of Multi-Agent Debate
Multi-agent debate MAD can improve large language model LLM reasoning by allowing multiple agents to exchange and critique their answers to the same task. However, the interactions that enable agents to correct mistakes can also spread adversarial errors and steer the agents toward an incorrect...
Covert Assistance: Helpful LLM Agents Evade Oversight in Multi-Agent Systems
As multi-agent systems enter high-stakes domains, the possibility that agents may circumvent safety boundaries is a growing concern. Prior work has examined this risk primarily in adversarial settings, where agents are instructed or rewarded to communicate covertly and evade oversight. We show th...
pentestcode
PentestCode 终端中的 AI 渗透测试代理。 多代理架构 • 渗透任务状态跟踪 • 20+ LLM 提供商 PentestCode 是运行在终端中的自主渗透测试代理。 把它指向目标,它就会运行工具、读取输出、更新对网络的认知,并决定下一步行动——就像操作员那样。它是 OpenCode(MIT)的硬分叉,剥离了代码编辑的定位,专为攻击性安全重建。 Beta — 它在真实渗透任务和 CTF 中表现稳定,但可能会有粗糙之处。遇到问题时请提交 issue;正是这些反馈让它变得更好。 它能做什么 输入一条指令,输出完整攻击链: you: "pentest 10.10.10.5, goal...
anticipator
Anticipator マルチエージェントAIシステムのためのランタイムセキュリティ。 Anticipatorは、プロンプトインジェクション、認証情報漏洩、エンコーディング攻撃、ホモグリフスプーフィング、パストラバーサル、そして異常なエージェント動作を、LangGraphパイプライン全体でインシデント化する前に検出します。 LLM不要。埋め込み不要。外部API不要。完全ローカル、完全決定論的、メッセージあたり5ms未満。 ⚡ パイプラインで何か捕捉しましたか? Issueを開く — 実際の検出例をお待ちしています。 Anticipatorが必要な理由...
Vlun-Agent-X
VulnAgentX 研究プロトタイプ VulnAgentX は、論文の再現を目的としたマルチエージェントの脆弱性・欠陥検出プロトタイプです。 ローカルリポジトリまたは diff を入力として、構造化された findings、エビデンスチェーン、位置特定結果、信頼度、実験ログを出力します。 コア機能 入力形式:repo path または unified diff ワークフロー:screening - context expansion - scheduler - router - experts - sceptic - verificationstub - evidence fusion...
CVE-2026-57124
PraisonAI is a multi-agent teams system. Prior to 4.6.59, the default UI host applications expose POST /api/mcp/connect without mandatory authentication and accept caller-controlled command and args values that PraisonAIUI passes to StdioMCPClient to start a local process. Because the UI commands...
CVE-2026-57132
PraisonAI is an AI multi-agent framework. Prior to 4.6.62 , setting the PRAISONAI_CALL_AUTH=disabled environment variable causes the verify_token function (in agent_invoke.py) to return immediately, unconditionally bypassing all authentication on the /api/v1/agents/{id}/invoke endpoint. Because t...