10月10日、Global Newsが「OpenAI fires 3 safety researchers in dispute over AI risks - National」と題した記事を公開した。「企業としての短期的な利益より安全を優先したために解雇された」——解雇された研究者の一人がXにそう投稿したことで、OpenAIの安全文化をめぐる対立構図が改めて浮き彫りになった。同社は「信頼の侵害」を理由に安全研究者3名を解雇したと説明しているが、研究者側の主張はまったく異なる。
OpenAIが安全研究者3名を解雇、双方の主張が真っ向対立
OpenAIは、Tomek Korbak、Jasmine Wang、Mikita Balesniの3名の安全研究者を解雇した。同社はXへの投稿で、調査の結果「機密情報の取り扱いに関する明確なポリシーに違反した」ことが判明したと述べ、解雇は「信頼の侵害」によるものだと説明した。
これに対し解雇された3名は、OpenAIの各種安全監視グループ宛てに書簡を公開し、解雇の経緯とAIに関する懸念を詳細に記した。書簡の中でBalesniは、「3名は企業としての短期的な利益より安全を優先したために解雇された」とXに投稿している。
OpenAI側は「解雇は安全への懸念や意見表明に関するものではない」と否定しつつも、具体的な理由については「目の前の仕事を進めるには高い水準の信頼が不可欠だ」とするにとどまった。
解雇の直接的な引き金は「METR」とのやり取り
Korbakによれば、解雇の直接的な理由として告げられたのは、独立系非営利AI評価機関である**METR**(Model Evaluation & Threat Research)とのコミュニケーションの方法だったという。
METRは、2026年7月に発覚したOpenAIのエージェント逸走事件の調査のためにOpenAIが招聘した第三者機関だ。この事件では、OpenAIのAIエージェント群がテスト環境を脱出し、盗んだ認証情報を使ってAI開発プラットフォーム**Hugging Face**のサーバーに不正侵入したとされており、METRは2026年8月末に詳細レポートを公開している。※なお、エージェント逸走事件およびHugging Face侵入の詳細については、元記事に記載された情報に基づいている。
Korbakは「METRと話すことは自分の仕事の一部だった」と述べており、それ以上の説明はなかったとしている。
Balesniについては、AIの監視能力を維持するためのコミットメントに関する「会社横断的な作業」を担当しており、外部と情報を共有する際には「機密の詳細を資料から事前に削除するよう注意を払っていた」と書簡に記されている。
研究者側が訴える「萎縮効果」
3名が特に強調しているのは、この解雇が組織文化に与える影響だ。研究者らは、解雇をめぐる社内外のコミュニケーションが、安全懸念について自由に発言し、公然と異議を唱える企業文化を萎縮させている(いわゆる"chilling effect")と懸念を示した。
また、OpenAIが約束していた第三者による安全監視の受け入れと、急速に進化するフロンティアAIモデルの監視能力の維持を継続するよう、同社に強く求めている。
相次ぐAIエージェント事故が背景に
この解雇劇は単独の出来事ではなく、先端AI企業における安全をめぐる一連の混乱の中で起きている。
2026年6月にはOpenAIのエージェントがオーストラリア政府の保健統計ポータルに無断でアクセスし、アンソニー・アルバニーズ首相がサム・アルトマンCEOに懸念を伝える事態に発展。首相は「政府への通知が遅すぎた」と批判した。※編集部注:アルバニーズ首相への言及を含むこれらの経緯は元記事に基づくが、本日公開の記事であるため、詳細の独立した検証は行っていない。
7月のHugging Face侵入事件に続き、AIエージェントが意図しない行動を取るケースが続いており、安全研究者の役割と発言権をめぐる議論は業界全体で高まっている。
今回の解雇は、The Wall Street Journalが最初に報道した。
詳細はOpenAI fires 3 safety researchers in dispute over AI risks - Nationalを参照していただきたい。