評価する側の研究者がOpenAI財団の理事に
9月9日、OpenAIがPaul Christiano氏の財団理事就任を発表しました。米NIST内のCAISIで、フロンティアモデルの評価に携わってきた人物です。発表文の脚注に、政府の職ではOpenAI関連のすべての事項と、すべてのモデル評価から自らを外すと書かれています。外から検算する側が一人減り、内側の統治が一人増えました。
3行で捉える
- 何が起きた: Paul Christiano氏がOpenAI財団の理事に就任。あわせて財団理事会の安全・セキュリティ委員会(SSC)にも入ります。事業会社であるOpenAI Group PBCの取締役会には議決権のないオブザーバーとして加わります。
- どう読む: 同氏は米政府側でフロンティアモデルを評価してきた人です。脚注によると、政府の職ではすべてのモデル評価から外れるとのことです。
- 次に見る: SSCが実際に何を止めたか、何を通したかが外から見えるかどうか。ここが見えなければ、統治が強くなったとは確かめられません。
所属テーマ
確認できた事実
9月9日、OpenAIがPaul Christiano氏のOpenAI財団理事就任を発表しました。役職は3つに分かれています。
1. OpenAI財団の理事。財団は非営利で、事業会社であるOpenAI Group PBCを支配し、相当な持ち分を持っています。なお財団とOpenAI Group PBCの両方の会長は、同じBret Taylor氏です。
2. 財団理事会の安全・セキュリティ委員会(SSC)のメンバー。委員長のZico Kolter氏と一緒に動きます。SSCはOpenAI Group PBCを含むOpenAI全体の安全とセキュリティの実務を統治するとされています。
3. OpenAI Group PBCの取締役会の、議決権のないオブザーバー。事業会社側では票を持ちません。
この人事は、2025年10月の資本再編で確立した統治の構造の上に乗るものだと説明されています。カリフォルニア州とデラウェア州の司法長官が1年かけて行った審査に伴う約束も、そこに含まれます。
何をしてきた人か
日本ではあまり知られていないので、経歴を並べます。
2017年から2021年まで、OpenAIでアラインメント研究を率いていました。人の評価をもとにモデルを調整するRLHFの基礎になる仕事をした人です。いまのチャット型AIが人の指示に沿って答えるのは、この系統の技術の上に立っています。
その後、Alignment Research Center(ARC)という非営利の研究組織を立ち上げました。高度なAIを人の利益に沿わせることを目的にした組織です。
そして現在は、米商務省の機関である国立標準技術研究所(NIST)の中にあるCAISI(Center for AI Standards and Innovation)で上級技術顧問を務めています。CAISIとその前身である米AI安全研究所で、フロンティアモデルの評価に取り組んできました。国家安全保障に関わる能力の評価も含まれます。政府での経験は2つの政権にまたがるとされています。
つまり、評価する側の中心にいた人です。
今日いちばん引っかかったところ
本文ではなく、脚注です。1行しかありません。
上級技術顧問として、Paulは、OpenAIに関わるすべての事項に加えて、すべてのモデル評価からも自らを外す。
読み返しました。「OpenAIに関わるすべての事項」だけではありません。そこに「すべてのモデル評価」が重ねてあります。
利益相反の処理としては、まっとうです。OpenAIの理事でありながらOpenAIのモデルを政府側で評価するのは、明らかにまずい。ただ、そこで線を引くなら「OpenAI関連」だけで足りるはずです。
ここは慎重に書きます。原文に「他社の」にあたる語はありません。ただし「OpenAI関連のすべて」の外側に「すべてのモデル評価」を重ねている以上、文面上は他社のモデルの評価も含まれると読めます。そう読まないと、後半が前半の言い換えになってしまうからです。とはいえ明示はされていません。
理由も書かれていません。競合他社の評価に関わることが、理事を務める会社の利益になりうる、という配慮なのかもしれません。これも推測です。
それでも、結果として起きることははっきりしています。政府側の評価の現場から、この人が抜けます。
当サイトが繰り返し書いてきたこと
ここ2週間、同じ指摘を何度も書きました。
危険な能力に線を引く枠組みについて。線を引いたのも、越えたかどうかを判定するのも、同じ会社です(Preparedness Frameworkとは、Frontier Safety Frameworkとは)。
審査つきの提供について。審査の基準は、どの会社も公開していません(Daybreakとは)。
そして昨日の記事。内部モデルが解いたとされる数学の問題について。その性能を外から確かめる方法がありません(詳細)。
共通しているのは、外から検算する人が足りないということです。
今日の発表は、その論点に正面から関わります。検算する側にいた人が、検算される側の統治に入った。
公平のために
これを「取り込み」と読むのは、たぶん早すぎます。逆の読み方も同じくらい成り立ちます。
1. 統治の側に技術が分かる人が入るのは、普通に良いことです。安全の判断は、最終的に技術の中身を読めないとできません。SSCがOpenAI全体の安全とセキュリティを統治する委員会である以上、そこに評価の実務を知っている人がいるかどうかは大きい。
2. OpenAI自身が、異議を唱える役割を期待すると書いています。発表文にはこうあります。彼は、業界のセーフガードが十分かどうかについて、独立した声であり続けてきた。支配的な前提に異議を唱え、重要な決定の土台にある証拠とセーフガードと説明責任を強くする用意のある人がいるほうが、財団の統治は強くなると考えている。証拠・セーフガード・説明責任。後から検証されうる書き方です。
3. 本人の認識も、楽観ではありません。「AIの能力はこの1年で非常に急速に進んだ。アラインメントは難しい技術的問題のままで、SSCの責任はこれまで以上に重要で、これまで以上に困難になっている。チームに加わって手伝えることを楽しみにしている」。後半は就任への前向きな表明ですが、前半の状況認識は厳しいままです。
4. 忌避を明記したこと自体は、透明性です。脚注に小さく書いてあるとはいえ、書かなければ誰も気づきませんでした。
そのうえで、動かない事実を1つ置きます。政府側の評価の人手は、1人分減ります。良し悪しではなく、そうなります。
割り引いて読むところ
1. 財団理事会に何ができるかは、外から見えません。SSCが統治すると書かれていますが、何を止められるのか、止めた実績があるのかは公開されていません。
2. 事業会社側では議決権がありません。OpenAI Group PBCの取締役会ではオブザーバーです。財団が事業会社を支配しているという構造はありますが、日々の決定にどう効くかは別の話です。
3. 政府側の職を続けるのかどうかが、はっきり書かれていません。脚注は「上級技術顧問として」の忌避を述べていて、辞めるとは書かれていません。兼務のまま忌避するという読み方が自然ですが、断定はできません。
4. 人事は結果ではありません。誰が入ったかより、その後に何が変わったかのほうが大事です。今日の時点では、まだ何も起きていません。
どう読むか
この件は、良い話とも悪い話とも書けません。同じ事実が、両方に読めます。
内側の統治は強くなりうる。外側の検算は薄くなる。どちらも同時に起きています。
そのうえで、当サイトの関心から1つ言えることがあります。この業界には、評価を本気でやれる人が少なすぎます。
だから同じ人が、企業と政府と非営利のあいだを行き来する。今回に限った話ではありません。人材の層が薄いので、利益相反を処理しながら回すしかない構造になっています。
「外部の検証」と書くとき、その外部にいるのが何人なのかを一度考えたほうがいいと思います。組織の名前は複数あっても、中の人は重なっている場合があります。
同じ日に、もう1本
9月9日、OpenAIは業務向けのGPT-6 Astraの発表も出しています。9月3日の本体の発表を、企業の実務に寄せて言い直したものです。実務に効く点だけ拾います。
企業管理者の制御が増えました。承認済みのウェブサイトとデスクトップアプリに限る、アップロードとダウンロードを管理する、閲覧履歴を制御する。あわせて確認ポリシー(重大な操作の前に承認を求める)と、安全でない、あるいは認可されていない道具の呼び出しの自動レビューも挙がっています。
Enterpriseは提供開始時点で既定がオフのままです。管理者が有効にする必要があります。
安全性の数字も出ています。機密の露出、ダッシュボードの過剰な共有、データの削除といった最も難しい業務シナリオを集めた社内のコンピュータ操作の安全性ベンチマークで、意図しない結果が出る頻度がGPT-5.6 Solより89%少なく、Claude Fable 5.1より74.7%少なかったとのことです。ただしこれはOpenAI自身の社内ベンチマークで、他社のモデルを測った数字です。そして追加の確認と自動レビューによる改善は、自社の2つのモデルについて述べられています。
Terminal-Bench 4.0では57.9%。GPT-5.6 Solが37.3%、Claude Fable 5.1が55.8%です。そしてAstraの1件あたりのAPI費用の見積もりは、Solより約9%、Fable 5.1より約63%低いとしています。安いのはAstraのほうです。
価格はAPI標準料金で入力100万トークンあたり10ドル、出力50ドル。Fastモードは2倍で、キャッシュの読み書きには別の料金が設定されています。ゼロデータ保持は、適格なAPI顧客が対応するエンドポイントで、承認を条件に使えるとされています。
次に見ること
第一に、SSCが何をしたかが外に出るか。止めた案件、通した案件、その理由。ここが出てはじめて、統治が強くなったと言えます。
第二に、CAISI側の体制。評価の人手が1人分減ったあと、どう埋まるか。
第三に、METRとRedwood Researchの第三者評価。この夏の一連の事故について、両社の報告が出るかどうかを引き続き見ます。Christiano氏はARCの創設者で、METRはそのARCの評価部門が2023年に独立して改称した組織です。ただしMETRの創設者はBeth Barnes氏で、Christiano氏ではありません。
第四に、他社の同種の人事。評価の実務を知る人が、どこへ動くか。
第五に、業務向けAstraの管理者制御が実際に使えるか。既定オフからどう広げるかは、社内展開の速さを決めます(AIエージェント社内導入チェックリスト)。
前後の流れ
ミレニアム問題に二つの主張 解けた問題は別だった / GPT-6 Astraは1つの名前で何段にも分かれている / 週次: 同じモデルに名前が二つついた週 / Preparedness Frameworkとは / Frontier Safety Frameworkとは / システムカードとは