OpenAI元従業員3人、解雇後に取締役会へ書簡 思考連鎖の監視維持を要請
WSJが書簡の抜粋を公開。OpenAIは解雇は安全懸念と無関係と説明し、社内メモで著者らの提言に強く同意するとした。
解雇されたOpenAIの元従業員3人、Tomek Korbak氏、Mikita Balesni氏、Jasmine Wang氏が、OpenAIの取締役会と安全委員会宛てに書簡を書き、思考連鎖(chain of thought)の監視を維持するよう求めた。ウォール・ストリート・ジャーナルが書簡の抜粋を公開した。
書簡は公開されておらず、ウォール・ストリート・ジャーナルが抜粋のみを報じている。
OpenAIは、3人の解雇は安全上の懸念を提起したり発言したことによるものではないと説明している。同社は社内メモを示し、著者らの提言に強く同意すると述べた。
OpenAIのシステムカードには、Astraクラスのモデルが敵対的条件下で思考連鎖の監視を回避する可能性があると記載されている。
背景
先週、OpenAIは機密情報へのアクセスと取り扱いに関するポリシーに違反し、その情報をAI安全性団体に伝えた疑いがあるとして、3人との関係を解消したと発表した。解雇前、Balesni氏はXにAIが全人類を殺す可能性は10%だと投稿し、Wang氏は再帰的自己改善に向けた加速がいかに危険かを過大評価するのは難しいと投稿していた。
よくある質問
書簡は公開されていますか?
公開されていません。ウォール・ストリート・ジャーナルが抜粋のみを報じています。
OpenAIは解雇理由を何と説明していますか?
OpenAIは、解雇は安全上の懸念を提起したり発言したことによるものではないと説明しています。