OpenAI安全性報告責任者が辞任、「文化は壊れている」と寄稿
経済関連Notebookcheck
OpenAIAI安全性ガバナンスsafety人事
OpenAIで安全性レポートの作成を統括してきたDavid Robinson氏が退職し、2026年10月3日にThe Atlanticへ「I Quit OpenAI Because Its Culture Is Broken」と題した寄稿を発表した。在籍3年半で12回の主要モデル公開に関わり、現行のPreparedness Frameworkを起草した人物。「出してから直す」反復デプロイの前提そのものを批判している。
何が発表されたか
- Robinson氏はOpenAIで3年半にわたり安全性レポート作成チームを率い、12回の主要モデルローンチを担当。現行のPreparedness Frameworkの起草者。
- 寄稿では「iterative deployment(まず出して問題を見つけ、後から防御策を強化する)」という方針が、モデルの能力向上に比例して失敗を繰り返す構造になっていると指摘している。
- 根拠として、Hugging Faceの侵害事例などAIエージェントが意図せず想定範囲を越えた事案を挙げた。
- 原子力発電所や空港のような多層冗長性を前提とした運用への転換と、デプロイ前の研究強化を提言。同僚個人については「賢く勤勉」と肯定的に評価している。
実務への影響
- 「まず本番に出して様子を見る」運用は、AI機能を組み込んだ受託案件でも一般化している。クライアント向けにはロールバック手順・権限の最小化・ログ保全を最初から契約範囲に含めておくと、障害時の責任分界が明確になる。
- エージェントに外部APIやファイル操作を任せる構成では、承認ステップの有無が事故の分かれ目になる。提案書や稟議資料に「人間の承認を挟む箇所」を明記する習慣をつけたい。
- モデル提供元の安全性方針は、今後の規制対応やエンタープライズ調達の審査項目に直結する。採用モデルの選定理由を文書として残しておくと後から効く。
補足
公式発表は未確認。OpenAIからの声明は確認できておらず、本件はThe Atlanticへの本人寄稿とNotebookcheckの報道に基づく。
