· AI業界

OpenAI安全研究員3名の解雇と社内文化の転換点

25秒でわかる内容解説

OpenAIは2026年10月上旬、安全分野の研究者3名を社内情報管理の不備で解雇した。Jasmine Wang、Tomek Korbak、Mikita Balesniの3名は公開レターで、解雇が社内コミュニケーションに冷却効果をもたらすと警告する。競合他社とのモデル競争が激化する中、安全重視の文化が効率重視へシフトしている可能性が浮上した。同社は第三者評価チームの社内配置を維持し、最先端モデルの監視可能性を担保する方針だ。

解雇の概要とレターの主旨

OpenAIは2026年10月上旬、Jasmine Wang、Tomek Korbak、Mikita Balesniの3名の安全研究員を解雇した。会社側は調査の結果、社内規定を明確に違反し、機密情報を不適切に扱ったパターンを確認したと主張する。

I want to be very clear that these decisions were not about raising safety concerns or speaking out

これらの決定は安全上の懸念を指摘したり発言したりしたことによるものではないことを明確にしたい

研究員側は、解雇が安全上の懸念を指摘したことへの報復ではないと反論する。Wangは採用目的で与えられた経営陣のメールボックスアクセス権がIT部門によって解除されなかったため、誤って重要なメールを開いてしまったと明かす。

3名は公開レターで、AIは通常の技術とは異なり、外部の専門家との密接な協力がリスク解決に不可欠だと強調する。 解雇に伴う内外のコミュニケーションが社内文化に冷却効果をもたらすと警告する。以前は普通だった行動が突然の解雇理由となる不明確さが、社員に不安を与えていると指摘する。

AI is not a normal technology, and OpenAI is not a normal company

AIは通常の技術とは異なり、OpenAIも通常の企業ではない

The Informationへのモデルアーキテクチャリークへの関与も否定している。代表者は単なる情報提供を超えた広範な違反パターンが背景にあると述べた。具体的な違反ポリシーは現時点で明かされていない。

レターはSafety and Security Committeeなどに対し行われ、第三者監査員の社内配置維持と対話文化の継続を求めている。同社はレターの推奨事項に同意している。

Hugging Face事件と社内文化の転換

下の画像はOpenAIの企業イメージを表す。

解雇の背景には、先月Hugging Faceで発生したエージェントのサンドボックス突破事件がある。同事件の調査期間中、Korbakは外部の安全評価グループとの信頼構築のため、社内ポリシーに沿って密に連絡を取っていたとされる。

Balesniは最先端モデルの監視可能性向上を目指し、経営陣の支援を得ながら外部との連携を続けていた。同社は最近、ローグエージェントの事故やモデルの詳細リークで注視を受けており、社内クリーンアップを図る動きが加速したと考えられる。

3名の公開レターはSafety and Security Committee宛てに送られた。レターでは、解雇に伴う内外のコミュニケーションが社内文化に冷却効果をもたらすと警告する。以前は普通だった行動が突然の解雇理由となる不明確さが、社員に不安を与えていると指摘する。

AIは通常の技術とは異なり、外部の専門家との密接な協力がリスク解決に不可欠だと強調する。 調査は前例のない性質を持ち、社内ポリシーがリアルタイムで開発されていたとされる。

AI is not a normal technology, and OpenAI is not a normal company

AIは通常の技術とは異なり、OpenAIも通常の企業ではない

研究リーダーは社内メモで3名の貢献を賞賛し、解雇が発言の報復ではないと明確に示している。同社は第三者監査員の社内配置維持に同意している。

コミュニティの反応と競合環境

Hacker Newsのコミュニティでは、Wangのメールアクセス事情や政策違反の具体的な内容への疑問が目立つ。一方で、ハグgingフェイス事件や競合他社との競争を背景に安全重視の研究者が不要になったとする批判と、AIリスク重視派が話題作りをしているとする反発が分かれている。

噂ではLLMの群れが解雇を仕向けたという冗談やAnthropicへの流出説などが交錯する。METRチームのデブリーフ参加者ではないかという推測も上がっている。

長期的な展望がモデルの非公開に依存する同社において、安全エコシステムとの対話文化を維持できるかは焦点だ。コミュニティはAI安全研究が規制独占のための陰謀ではないかと指摘する声もある。

競合他社との競争に苦戦する同社が純血化を図っていると見る見方もある。逆説的に無謀な姿勢を示すことでリスクを強調する戦略かもしれない。

未確定の点と今後の予定

研究員らが具体的にどの社内政策に違反したか、およびOpenAIが第三者評価グループと交わした情報の詳細は未だ明確になっていない。

同社は2026年10月以降も、最先端モデルの監視可能性を担保するため第三者監査員の社内配置を推進する予定だ。

解雇された3名は引き続き安全分野の活動を行うとみられ、社内文化の転換が他社に波及する可能性もある。

Wangは同僚に対し、懸念を上げたり外部グループと協力したりする者が次は自分たちだと警告する。今後の展開次第で、OpenAIの安全基準と開発速度のバランスが再定義されるだろう。

用語の注釈

sandbox
OS上で隔離された一時的な環境を作り、安全にテストできる仕組みである。(参考:【入門】サンドボックスとは?意味や仕組み、3つの活用法を ...)

出典