1 matches found
Exponentiated-Gradient-Descent-LLM-Attack
Readmeファイルを変更する。 これは、整列された大規模言語モデルを攻撃するための敵対的サフィックスを生成するために、Exponentiated Gradient Descent最適化手法を探求するプロジェクトです。 この手法は、70億パラメータのLlama-2チャットモデルに対して有効であることが示されています。 pgdスクリプトを複数のビヘイビア(例:20)で実行するには、シェルで以下のコマンドを実行します。 python runpgd.py --inputfile...
5.9AI score
SaveExploits0
20