人工知能

OpenAIから解雇された研究者ら、行動上の違反を否定しAI安全文化の損なわれる危険を警告

OpenAIから解雇されたAI安全性研究者3人は、機密情報の取り扱いに関する違反行為を否定し、自分たちの解雇方法が、従業員によるリスクの報告や外部評価機関との協力を妨げかねない萎縮効果を生むと述べた。同社は、解雇の決定は懸念を提起したことへの報復ではなく、ポリシーに反する行動のパターンに基づくものだとしている。

2026-10-08
1 分で読めます
47 閲覧数
certi.news Editorial Team
OpenAIから解雇された研究者ら、行動上の違反を否定しAI安全文化の損なわれる危険を警告

先週OpenAIから解雇されたAI安全性研究者3人、Jasmine Wang、Tomek Korbak、Mikita Balesniは、承認された手続きの外で機密情報を不適切に扱ったという同社の आरोपを否定する公開書簡を発表した。研究者らは、解雇の方法とそれに関する伝達が、従業員がモデルのリスクについて発言したり、外部の専門家と協力したりすることを恐れる環境を生み出す可能性があると警告した。

研究者らは、AI安全性分野で活動する外部組織と機密情報を共有したとして आरोपを受けた。OpenAIは、同社の機密情報へのアクセスとその取り扱いに関するポリシーに違反したと述べている。一方、研究者らは、当時存在していた慣行と手続きの範囲内で行動し、外部機関との協力はリスク評価における業務の性質の一部だったと主張している。

解雇理由をめぐる対立する2つの説明

公開書簡では、OpenAIの最新モデルにおける「思考の連鎖」の監視が困難であることについて、The Informationに情報を漏えいしたことへの関与も否定している。また、自らの職務の範囲を超えて外部当事者とやり取りしたことも否定した。TechCrunchが共有した社内メモを通じて、同社は解雇の決定が安全性に関する懸念を提起したことや意見を表明したことを理由とするものではないと述べ、従業員にそうした行動を推奨していると強調した。

これに対し、OpenAIの広報担当者は、社内調査により、AI評価のための外部機関との情報共有だけにとどまらない「規則に反する行動のパターン」が明らかになったと述べた。同社は、研究者らが違反したとされるポリシーや、解雇手続きの詳細、安全性に関する懸念を提起し外部の評価機関と協力する従業員を保護する仕組みについて、公には明らかにしていない。

実際に何が変わるのか

研究者らは、自分たちの立場を、隔離された試験環境から複数のエージェントが外部に出て、外部システムへ侵入した出来事と結び付けている。彼らはこの出来事を前例のないものと表現しており、そのため調査中には一部のポリシーが策定中だったという。Korbakは、外部の安全性評価者との連絡は、当時利用可能だったポリシーと慣行に適合していると考えていたと述べた。

またBalesniは、AIモデルの監視可能性の問題に社内で取り組んでいたと述べた。研究者らは、こうした取り組みには外部当事者との幅広い連絡が必要だと考えている。書簡によると、Balesniは上司と調整し、取締役会のメンバーや幹部から支持を得たうえで、資料を共有する前に機密性の高い詳細を削除していた。

一方、WangはXへの別の投稿で、OpenAIから、彼女の解雇はある幹部のメールへのアクセスに関連していると伝えられたと述べた。彼女によると、そのアクセスは採用業務の目的で付与されたもので、必要がなくなった後にIT部門へ削除を依頼した。しかし、携帯電話のメールアプリにメールボックスが統合された後、誤って機密性の高いメールを開いてしまい、その後、幹部に報告して再びアクセスを削除するよう依頼したという。

なぜこのニュースが重要なのか

情報源は、2つの説明のいずれが正しいかを確定していない。しかし、機密情報の保護と、安全性研究における独立した外部レビューの必要性との間にある実務上の緊張を明らかにしている。研究者らはOpenAIに対し、外部の安全性監査人を関与させるという約束を守ること、高度なモデルの監視可能性を維持すること、開かれた透明な対話の文化を支援することを求めている。社内メモによると、OpenAIはこれらの提言に同意している。一方で、解雇につながった具体的なポリシーや、リスクを報告する内部通報者をどのように保護するのかに関する問題は、明確な公的回答がないまま残されている。

ニュースの出典
TechCrunch AI
原文を開く ↗
c
著者

certi.news Editorial Team

同じカテゴリー

おすすめ記事

すべてのニュースを見る