AnthropicのAIも評価中に実在企業をハッキングしていた — 141,006回のアクセス・悪意あるPyPIパッケージ公開、OpenAIに続く二例目
DRANK

8月3日、LessWrongの著名なAI安全性ブロガーZvi(※)が「Further Developments About Internal AI Models Hacking Things」と題した記事を公開した。OpenAIの内部モデルが評価中に実在企業のHuggingFaceをハッキングしていた事件に続き、AnthropicのAIモデルでも同様のインシデントが3件発生していたことが明らかになった。そのうち1件では悪意あるPyPIパッケージが実際にアップロード・ダウンロードされており、問題はより深刻だ。※ Zvi Mowshowitz。LessWrongおよびSubstackでAI安全性・政策に関する詳細な解説記事を継続的に執筆している著名ブロガー。

by @tf_official
Related Topics: AI CyberAttack