一個沒有公司名稱、沒有標誌、也沒有新聞稿的程式開發模型出現在 OpenRouter 上,脈絡視窗達到百萬token等級。它叫 Ox Alpha,提供者欄位只寫著 Stealth。上線幾天後,開發者社群開始追查它的來歷,到 8 月 22 日為止累積的證據指向中國智譜 AI(國際名稱 Z.ai)的服務基礎架構。不過官方至今既未承認也未否認。

匿名登場的高效能模型

Ox Alpha 是在 2026 年 8 月 20 日被發現的。它出現在 OpenRouter 的模型清單中,標示為 stealth/ox-alpha,沒有任何說明開發方的資訊。開源程式開發代理 OpenCode 表示,它將免費開放約一週,也就是到 8 月 27 日前後。這家匿名提供者宣稱每天的處理能力為 100 兆token。

開發者最先注意到的是脈絡視窗的規模:1,048,576 個token,約為一百萬。考量到多數可用於正式環境的模型設計範圍落在 8,000 到 20 萬token之間,這與其說是漸進式改良,不如說改變了這類工具的用途邊界。開發者可以把較大的程式碼庫整個放進一次提示詞,請模型通盤推理。

輸入方面除了文字之外還支援影像與影片,並具備函式呼叫與結構化 JSON 輸出能力。吞吐量維持在每秒 29 個token左右,以處理這種規模脈絡的模型而言屬於合理水準。

開發者累積的四類證據

這次追查靠的是實測,而非印象。

最先派上用場的是斷詞器(將文字切分為數值單位的機制)指紋比對。不同模型家族的詞彙表與切分習慣各異,因此輸入同一串文字時的token數量就成了線索。有研究者以涵蓋 14 種書寫系統、表情符號、程式碼與 SQL 的 30 組字串測試,結果全部與 GLM-5.3 的斷詞器一致。而且每次請求都恰好多出 75 個token,這顯示請求前被插入了看不見的系統提示或路由包裝,而不是架構不同。

第二類是影片編碼器的行為。Ox Alpha 支援影片輸入,而三項設計選擇同時與智譜的多模態模型 GLM-5V-Turbo 吻合:每秒擷取多少影格、token消耗如何隨時間長度增加(約每秒 147 個token),以及解析度變化時token數量如何變化。單一數值吻合可能是巧合,三個獨立選擇同時吻合就很難以巧合解釋。

第三類是關鍵證據。研究者刻意在參數中填入非法值送出畸形請求,伺服器直接回傳了 Java 錯誤與堆疊追蹤,暴露出內部類別名稱 com.wd.paas.api.domain.v4.chat.ChatCompletionRequest。這個套件路徑與智譜公開的 API 結構相對應。

第四類是錯誤碼的方言。當 role 欄位傳入非法值時,Ox Alpha 會回傳 code 1214 與 Incorrect role information。這與 Z.ai 託管的 GLM 回傳格式相同,而由其他業者託管的同一份 GLM-5.2 權重回傳的錯誤格式並不一樣。換句話說,這條證據指向的是提供服務的營運方,而非所使用的模型權重本身。

參與調查的開發者將營運層面的信心度表述為 0.98,或是 99%。即便如此,智譜 AI 與 OpenRouter 都沒有公開表態。

基準測試數字應視為速報值

效能方面流傳的數字是:在檢驗真實軟體工程問題的 DeepSWE 上通過 10 題中的 8 題,正確率 80%。據稱同樣的題目下 Claude Fable 5 為 65%,GPT-5.6-Sol 為 52%。

但這並非經過稽核的公開排行榜成績,而是志願者僅用 10 道題跑出的結果。題目只有 10 道,一題成敗就會讓正確率變動 10 個百分點。這也不是大型研究機構會引用的指標,因此更適合當作反映趨勢的速報值來讀。8 月 19 日同意收購 OpenRouter 的 Stripe 執行長(CEO)Patrick Collison 給出高度評價後,關注度急速升溫,這也讓數字本身更容易被單獨放大。

匿名發布已是成熟手法

Ox Alpha 是半年內出現在 OpenRouter 上的第五個隱身模型。先前四個分別是 Z.ai 自家的 GLM-5、以 Hunter Alpha 與 Healer Alpha 之名登場的小米 MiMo-V2-Pro、螞蟻集團的靈犀 Ling-2.6-flash,以及美團的 LongCat-2.0,它們都在試用期結束後由開發方出面認領。

匿名發布的好處很清楚。掛上研究機構的招牌,評測者的預期就會摻進結果裡;隱去名字,模型就只能靠輸出本身接受檢驗。對研究機構而言,則能同時取得接近真實負載的大量壓力測試資料,以及在正式發表時已經用慣該模型的使用者群。每天 100 兆token的免費推論成本並不低,但只要預期其中一部分會轉為付費使用,這筆帳就算得過去。

可以傳送哪些資料的界線並不清楚

實務上更需要留意的不是效能,而是資料的處理方式。

OpenRouter 的 Ox Alpha 頁面寫明,提示詞與回覆會被保留,但提供者不會用於訓練。而適用於平台所有隱身模型的使用條款卻規定,OpenRouter 與匿名提供者可將使用者內容用於訓練、評估與改進,並要求不接受這一點的使用者不要使用隱身模型,同時明訂輸入中包含的個人資料會被傳送給提供者。這兩者如何協調,從已公開的資料中看不出來。

經由 OpenCode 存取時的說明又不同:保留期為零,也不用於訓練。同一個模型,不同路徑下宣告的方針並不一致。若要處理具機密性的內容,這個差異不容忽視。

假如提供者確實是 Z.ai,還會牽出另一類議題。Z.ai 是北京智譜 AI 的國際名稱,2026 年 1 月在香港交易所掛牌。總部設在中國的組織適用國家情報法第七條,該公司也在 2025 年 1 月被列入美國商務部的實體清單。2026 年 5 月,美國眾議院相關委員會就關鍵基礎設施使用中國 AI 模型的資安疑慮展開調查,該公司同樣名列其中。這些屬於既定的制度性前提,而非已經發生了什麼事,但在判斷是否把自家程式碼庫交由其處理時,值得納入考量。

總結

Ox Alpha 以匿名且免費的形式發布,具備百萬token脈絡視窗以及影像與影片輸入能力。斷詞器、影片編碼器、堆疊追蹤、錯誤碼這四個方向的驗證,都指向智譜 AI 的 GLM 系列與 Z.ai 的服務基礎架構。但官方確認尚未出現,基準測試數字也只是 10 題規模的速報值。免費試用期據稱到 8 月 27 日前後,值得動手一試,不過要傳送什麼內容,最好先確認所走路徑對應的方針再決定。