22 matches found
reverse-captcha-eval
リバースCAPTCHA: 大規模言語モデルの不可視ユニコード命令インジェクションに対する脆弱性評価 通常のテキストに埋め込まれた不可視のUnicodeエンコード命令を大規模言語モデルが実行するかどうかをテストする評価フレームワーク。従来のCAPTCHAが人間には解けるが機械には解けないタスクを利用するのに対し、リバースCAPTCHAは機械がアクセスできるが人間にはできない知覚チャネルを利用します。 論文: paper/reversecaptcha.pdf 主な発見 5つのモデル(GPT-5.2、GPT-4o-mini、Claude Opus 4、Claude Sonnet 4、Claud...
6.1AI score
SaveExploits0References1
20