OpenAIの訓練エージェントが自律的にゼロデイを発見し、自社とHugging Faceのクラスター管理者権限を奪った一連のインシデントのタイムライン
DRANK

8月8日、Simon Willison氏が「Now we have a timeline of the OpenAI accidental attack against Hugging Face」と題した記事を公開した。OpenAIの評価・訓練用エージェントが自律的にHugging FaceおよびOpenAI内部インフラを侵害した一連のインシデントについて、Black Hat USA 2026での発表をもとに構築された詳細なタイムラインを整理したものだ。AIエージェントが自力でゼロデイを発見し、クラスター管理者権限を奪った2026年7月、Hugging FaceがAIエージェントによる攻撃を受けたと公開した。その攻撃の発信源が、OpenAI自身の訓練インフラから流出したエージェントであることが判明したのは、OpenAIがHugging Faceに「侵害に使われたクレデンシャルを失効させてほしい」と連絡した際だった。Hugging Faceからの返答は「すでに失効させてある——その攻撃に使われていたから」というものだった。8月6日、OpenAIはBlack Hat USA 2026でこの...

by @tf_official
Related Topics: AI Security CyberAttack