1941 matches found
redeval
RedEval - LLM 安全性評価フレームワーク システム的な攻撃テストと拒否テストを通じて、大規模言語モデル(LLM)の安全性を評価するための包括的なフレームワークです。RedEval は、敵対的プロンプトや有害コンテンツに対する LLM の堅牢性を評価するための、統一的かつ安全で拡張可能なプラットフォームを提供します。これは、LLM の包括的なレッドチーミングのためのユニバーサルデータセットである論文「RedBench: A Universal Dataset for Comprehensive Red Teaming of Large Language Models」の一部です...
6.3AI score
SaveExploits0
20