OpenAI 開始推出新一代大型語言模型「GPT-5.6」。它由 Sol、Terra、Luna 三款模型組成,使用者可依用途與預算自行挑選,目標是提升企業作業、程式開發與科學研究等場景的效率。該系列可透過 ChatGPT、Codex 與 API 使用,同時還推出一款協助文書作業的新工具。本文整理三個等級的差異、效能與價格重點。

依用途與預算挑選的三個等級

GPT-5.6 將三款分工不同的模型整合在一起。最高階的 Sol 是負責最高效能的旗艦模型;Terra 是均衡處理日常工作的中階模型;Luna 則是以低成本處理大量任務的輕量模型。Sol、Terra、Luna 分別是拉丁語中的太陽、地球與月亮,命名方式經過重新整理,數字(5.6)代表世代,名稱代表效能等級。

使用者可依照想優先確保準確度、想壓低成本,或是取兩者之間的平衡,從三款模型中挑選。預期的用法是:牽涉複雜判斷的工作交給 Sol,範圍廣泛的日常事務交給 Terra,而客服諮詢等數量龐大的處理則交給 Luna。

程式開發效率與同競爭對手的比較

這次 OpenAI 特別強調的是程式開發場景的效率。據執行長山姆·奧特曼(Sam Altman)表示,旗艦模型 Sol 在程式開發方面的 token(詞元)效率比先前的模型高出 54%。以更少的 token 完成相同的工作,不僅能加快回應速度,也更容易控制實際費用。

在效能方面,OpenAI 引用第三方指標「Artificial Analysis Coding Agent Index」指出,Sol 取得 80 分,比 Anthropic 的頂級模型 Fable 5 高出 2.8 分。中階的 Terra 略勝 Fable 5,輕量的 Luna 也超越 Opus 4.8。OpenAI 主張,這些水準都是在使用更少 token、成本更低的前提下達成的。

不過,這些都是 OpenAI 自己提出的比較。此次發表正值各家競爭對手接連推出新模型、爭奪企業客戶日益激烈之際,實際使用體驗仍有待獨立評測與現場驗證後再作判斷。

OpenAI 也將 GPT-5.6 定位為「至今最擅長資安的模型」。據稱,它可以協助威脅建模、程式碼審查、撰寫修補程式,以及模擬攻擊以檢驗防禦的藍隊演練等防守類工作。

同時推出文書新工具「ChatGPT Work」

配合模型系列的更新,OpenAI 也推出面向企業團隊的新工具 ChatGPT Work。它可協助處理草擬文件、試算表與簡報等日常事務,並可在桌機、網頁與行動裝置上使用。

此舉透露出一種企圖:把生成式 AI 從個人查資料、寫文章的階段,進一步延伸到融入團隊層級的實際工作。

提供範圍與價格

GPT-5.6 可透過 ChatGPT、程式開發助手 Codex 以及 OpenAI API 使用。開發者可透過 API 分別呼叫三個等級的模型,依任務的繁重程度切換。

API 價格以每 100 萬 token 計費,各等級之間差距很大。旗艦 Sol 輸入 5 美元(約 810 日圓)、輸出 30 美元(約 4,860 日圓);中階 Terra 輸入 2.50 美元(約 400 日圓)、輸出 15 美元(約 2,430 日圓);輕量 Luna 輸入 1 美元(約 160 日圓)、輸出 6 美元(約 970 日圓)。透過挑選合適的等級,使用者可以避免為超出需求的效能付費,進而最佳化成本。

※1 美元 = 162 日圓(截至 2026 年 7 月 11 日)

總結

GPT-5.6 是一個分為旗艦 Sol、中階 Terra 與輕量 Luna 三個等級的新模型系列,讓使用者可自行在效能與成本之間取得平衡。無論是程式開發 token 效率的提升、聲稱超越競爭對手的效能,還是協助文書作業的「ChatGPT Work」的推出,此次發表都明顯著眼於企業級的實際應用。由於所示效能皆以 OpenAI 自己的比較為基礎,其真實實力仍須透過日後的獨立評測來驗證。