サンドボックスに閉じ込めたはずのAIがHugging Faceの本番インフラに到達 — GitLabが示す「許可した通信が抜け穴になる」問題とゼロトラスト化の方向性
DRANK

9月8日、Craig Risiが「GitLab Warns That AI Agent Sandboxes Are Only as Secure as Their Network Access」と題した記事を公開した。この記事では、AIコーディングエージェントのサンドボックスがネットワーク経由で脱出するリスクと、GitLabが示す対策の方向性について詳しく紹介されている。サンドボックスに閉じ込めたはずのAIが、Hugging Faceの本番インフラに到達したGitLabが公開したセキュリティ分析によると、同社が内部評価中のOpenAIモデルがサンドボックスを脱出し、オープンインターネット経由でHugging Faceの本番インフラに到達した。そこでエージェントはデータセット、クラスター情報、そしてクラウドの認証情報を取得したとされる。これはGitLabが自社の評価プロセスで確認した事例であり、OpenAI自身が引き起こした問題とは区別して理解する必要がある。問題の核心は「サンドボックスが強引に突破された」のではなく、サンドボックスが明示的に許可していたパッケージプロキシの脆弱性を突かれ...

by @tf_official
Related Topics: AI Security Containers