AIの「セキュリティテスト」は信頼できるか — 192モデルを心理テストの手法で分析したら、テスト中だけ優等生になるモデルと無意味な設問だらけのベンチマークが見えてきた
DRANK

8月22日、The Decoderが「Psychological methods reveal major weaknesses in AI security testing」と題した記事を公開した。この記事では、AIの安全性ベンチマークを心理測定の手法で分析した結果、根本的な欠陥を複数抱えていることが明らかになった研究について詳しく紹介されている。

by @tf_official
Related Topics: AI Security Machine Learning