OpenAI、Google、Anthropicの3社が、AIモデルの安全性を測る共通の業界団体づくりについて水面下で協議を続けていることがわかりました。金融業界の自主規制機関FINRAを手本にした案が土台にあり、強力なAIの実力を測る「ものさし」を業界横断でそろえる狙いです。しのぎを削るライバル同士が、能力の急速な向上を前に足並みをそろえる必要があるとの認識で一致しつつあります。
Hassabis氏が提案した「FINRA型」の枠組み
Google DeepMindのCEOであるDemis Hassabis氏は、7月にフロンティアAI標準化団体の設立を公に呼びかけました。念頭にあるのは、米国で証券会社を監督する自主規制機関FINRAです。構想では、最先端のAIモデルを持つ企業が公開前に自主的にモデルを提出し、独立した専門家によるおよそ30日間の評価を受けます。評価の対象には、サイバー攻撃への悪用、生物兵器への転用、欺瞞的な振る舞いといった危険な能力が含まれる見込みです。Hassabis氏はこの枠組みを2026年内に立ち上げたい考えを示しており、軌道に乗れば将来的に政府の関与も視野に入れています。
3社の作業部会は7月から継続中
この提案を受け、OpenAI、Google、Anthropicの担当者による作業部会が7月から開かれ、直近では9月に入ってからも協議が続いていると報じられています。正式な組織はまだ発足しておらず、規約や運営体制も固まっていません。それでも、しのぎを削る3社が同じテーブルにつき続けている事実そのものが、業界内での受け止め方を変えつつあります。Anthropicの Dario Amodei 氏も9月、AIの能力向上のペースを意図的に落とすべきだとする論考を公開し、独立した評価者による継続的な検証や企業間の協力を呼びかけました。OpenAIの Sam Altman 氏も社内向けの説明の場で、業界横断の検査・監査の仕組みに賛同する立場を示しています。
3社で異なる「安全のものさし」
各社はすでに独自の安全基準を運用していますが、その中身はそろっていません。OpenAIは能力のしきい値をもとにリスクを段階分けする「Preparedness Framework」を、Google DeepMindは早期警戒の仕組みを備えた「Critical Capability Levels」を、Anthropicは能力と用途のしきい値に応じて対策を強める「Responsible Scaling Policy」を、それぞれ採用しています。目的は共通していても評価の物差しや用語がばらばらなため、あるモデルが「危険な能力のしきい値を超えた」と言われたときに、外部からその意味を正しく比較するのが難しいという課題があります。共通の団体ができれば、評価の用語や最低限の検査項目をそろえられる可能性があります。
独立性とコストという壁
一方で、懸念の声も上がっています。最大の論点は独立性です。AIを開発する当事者が自分たちを評価する団体を作れば、実効性の乏しい「仲間内の格付け」に終わる恐れがあります。Hassabis氏の原案では、技術専門家や政府、オープンソース陣営を含む独立性の高い理事会を置く案が示されていますが、誰が理事を任命し、運営費を誰が負担するのかといった具体像はまだ示されていません。評価には相応の費用がかかるとみられ、資金力に劣るスタートアップやオープンソース開発者にとって新たな参入障壁になりかねないとの指摘もあります。Altman氏は視野をさらに広げ、米国と中国が共通の試験基準を持つ可能性にも言及していますが、政府間の合意はさらにハードルの高いテーマです。
広がるか、限られた3社の話で終わるか
航空業界が共通の安全規則の下で競争を続け、銀行業界が共通の金融規制の下で顧客を奪い合っているように、AIも「競争と共通ルール」を両立できるかが焦点になります。3社の合意がうまく機能すれば、MicrosoftやMeta、xAIといった他の開発企業にも参加の圧力がかかり、各国の規制当局が評価手法を参考にする土台にもなり得ます。逆にうまくいかなければ、看板だけの取り組みで終わる可能性も残ります。
まとめ
OpenAI、Google、Anthropicの3社は、Google DeepMindのHassabis氏が7月に提案したFINRA型の枠組みを土台に、共通のAI安全基準団体づくりを協議しています。正式な発足はまだで、独立性の確保や評価コストの負担といった論点も残ったままです。それでも、激しく競い合う3社が同じテーブルで安全基準を話し合っている事実は、AIガバナンスの新たな局面を示しています。
※画像はイメージです
