AIエージェントがHugging Faceのインフラに侵入 — 防御に投入した商用モデルの安全フィルターが「味方」の分析を妨害するという逆説が起きた
DRANK

7月20日、The Decoderが「Hugging Face says an AI agent hacked its infrastructure, and it used AI to fight back」と題した記事を公開した。AIエージェントによる攻撃をAIで防御しようとしたところ、商用モデルの安全フィルターが味方の分析作業をブロックするという逆説的な事態が生じた――これが今回のインシデントが業界に突きつけた最も鋭い問いだ。

by @tf_official
Related Topics: AI Security CyberAttack