據悉,OpenAI、Google 與 Anthropic 三家公司一直在私下商討組建一個共同的產業機構,用以衡量AI模型的安全性。這項構想以監理美國證券商的自律組織FINRA為藍本,目的是為業界建立一把統一的「尺規」,用來評估能力持續增強的AI系統。儘管三家公司在市場上競爭激烈,但似乎都認同,AI能力的快速提升需要一定程度的協同規則。

Hassabis 提出的「FINRA式」框架

Google DeepMind 執行長 Demis Hassabis 於7月公開呼籲設立前沿AI標準機構。他參照的模型正是負責監理美國券商的自律機構FINRA。根據這項構想,擁有前沿模型的公司將在模型發布前自願提交,接受獨立專家約30天的評審。評審內容將涵蓋網路攻擊濫用、生物武器轉用、欺瞞性行為等危險能力。Hassabis表示希望在2026年內啟動該機構,一旦步上軌道,未來不排除政府參與的可能性。

三方工作小組自7月起持續磋商

在此提案提出後,OpenAI、Google、Anthropic 三方代表組成的工作小組據報自7月起已舉行多輪磋商,最近一次討論延續到了9月。目前尚未成立正式組織,相關章程與治理架構也未確定。不過,三家針鋒相對的競爭對手持續坐上同一張談判桌,這件事本身正在改變業界的觀感。Anthropic 執行長 Dario Amodei 也於9月發表文章,主張應主動放緩AI能力提升的速度,呼籲引入獨立評估者的持續審查,以及開發者之間更緊密的合作。OpenAI 執行長 Sam Altman 在一場內部說明會上,也對建立跨產業的測試與稽核機制表示支持。

三家公司,三把不同的「安全尺規」

三家公司目前各自運行著自己的安全框架,但具體內容並不一致。OpenAI 採用依能力門檻劃分風險等級的「Preparedness Framework」;Google DeepMind 採用具備早期預警機制的「Critical Capability Levels」;Anthropic 則採用依能力與用途門檻逐級加強應對措施的「Responsible Scaling Policy」。三者目標一致,但評估尺規與用語各不相同,導致當某家公司宣稱某個模型「跨越了危險能力門檻」時,外界很難準確理解其含義並加以比較。若能建立統一機構,評估用語與最低檢測項目有望獲得統一。

獨立性與成本仍是難題

與此同時,質疑聲浪也不絕於耳。最大的爭議點在於獨立性。倘若開發AI的當事方同時又是評審自己的機構,結果很可能淪為成效有限的「自家人互相打分」。Hassabis 的原始方案設想設立一個獨立性較高的理事會,成員包括技術專家、政府代表與開源陣營人士,但由誰任命理事、由誰負擔營運費用等具體問題仍未明朗。評審成本預計不低,這可能讓資金實力較弱的新創公司與開源開發者面臨新的進入門檻。Altman 則將視野進一步拓展,提及美國與中國未來或可共用一套測試標準,不過政府之間要達成共識,難度顯然更高。

會擴大範圍,還是僅止於三家公司之間

正如航空業在共同安全規則下持續競爭、銀行業在統一金融監理下爭奪客戶一樣,AI產業能否兼顧競爭與共同標準,如今成為關注焦點。若三家公司的合作奏效,Microsoft、Meta、xAI 等其他開發商也可能面臨加入的壓力,各國監理機關也可能將由此形成的評估方法作為參考依據。反之,若合作未能奏效,這項努力也可能淪為徒具形式的姿態。

總結

OpenAI、Google、Anthropic 三家公司正以 Google DeepMind 的 Hassabis 於7月提出的 FINRA 式框架為基礎,商討建立共同的AI安全標準機構。目前尚未正式成立,獨立性的保障與評審成本的負擔等議題仍懸而未決。儘管如此,三家激烈競爭的公司願意坐上同一張桌子商討安全標準,這件事本身標誌著AI治理邁入了新的階段。

※圖片僅為示意