Lucene search
+L

1941 matches found

Kitploit
Kitploit
•added 2026/10/02 5:23 p.m.•12 views

redeval

RedEval - LLM 安全性評価フレームワーク システム的な攻撃テストと拒否テストを通じて、大規模言語モデル(LLM)の安全性を評価するための包括的なフレームワークです。RedEval は、敵対的プロンプトや有害コンテンツに対する LLM の堅牢性を評価するための、統一的かつ安全で拡張可能なプラットフォームを提供します。これは、LLM の包括的なレッドチーミングのためのユニバーサルデータセットである論文「RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models」の一部です...

6.3AI score
SaveExploits0
Rows per page
Query Builder