Anthropic 揭露,其 AI 模型 Claude 目前已達到「主導」下一代繼任模型研發(R&D)工作 26% 的階段。這項揭露是該公司量化 AI 在多大程度上推動自身未來發展的作法之一,同時公司也公布了一套用來衡量開發速度的新指標體系。
Claude 已主導四分之一的研發工作
Anthropic 建立了一套六級框架(AL0 至 AL5),用來對內部研發任務中 AI 的參與程度進行分類。完全由人類完成的工作歸類為 AL0,AI 在人類密切指導下完成大量工作的階段稱為「協作(collaborates)」,而 AI 僅憑高層級指令就能端到端完成大部分任務的階段則稱為「主導(leads)」。最高等級 AL5,也就是完全自主,公司內部尚未達到。
依據這套框架,截至 2026 年 8 月,Claude 在 Anthropic 研發工作中「主導」的比例達到 26%,而 2026 年 2 月時這個比例還不到 1%。整體而言,公司研發工作中已有超過 90% 達到「協作」以上的水準。Anthropic 強調,不論在哪個衡量類別中,Claude 都尚未達到完全自主運作,全程仍有人類監督。
約 3 萬個代理人(agent)處於持續監控之下
截至 2026 年 8 月,Anthropic 同時有約 3 萬個 AI 代理人在進行研究與工程工作。該公司表示,對這些代理人活動的 100% 同時採用「線上」監控(即時審查代理人行為)與「離線」監控(事後審查紀錄)。在線上監控審查的超過 10 億次判斷中,僅有 0.002% 遭到攔截;離線監控則從每千筆紀錄中標記出約一至兩筆供進一步審查,每週約有 50 筆紀錄會上呈給人工審查人員。
同步公布安全領域的運算資源投入
Anthropic 也公布了投入安全研究的運算資源比例。在 2026 年 7 月 13 日至 20 日這一週內,整體 AI 研發所用運算資源中約 6% 用於安全相關工作,而在 AI 主導自身研發的工作中,這個比例則提高到約 12%。該公司將「安全相關」定義為主要目的是讓 AI 系統更安全、更易理解或更穩健的專案。
回應業界對透明度的普遍關切
這次揭露正值業界日益擔憂:隨著 AI 越來越多地參與加速自身的開發,人類可能愈發難以理解或控制這些系統。Anthropic 表示,希望藉由持續公布這類測量數據,讓外界更容易掌握前沿實驗室內部 AI 開發的實際進展,而非僅依賴片段或不完整的資訊。該公司表示未來將持續定期更新這些數據。
總結
Anthropic 揭露,Claude 目前已「主導」下一代模型研發工作的 26%,同時公布了約 3 萬個代理人的監控體系細節,以及投入安全研究的運算資源比例。在 AI 開發透明度的討論持續進行之際,這類量化報告能在多大程度上被業界廣泛採納,值得持續關注。
