OpenAI 开始推出新一代大语言模型「GPT-5.6」。它由 Sol、Terra、Luna 三款模型组成,用户可根据用途和预算进行选择,目标是提升企业办公、编程和科学研究等场景下的效率。该系列可通过 ChatGPT、Codex 和 API 使用,同时还推出了一款辅助办公事务的新工具。本文梳理三档模型的差异、性能与价格要点。
按用途和预算选择的三档模型
GPT-5.6 将三款分工不同的模型整合在一起。最高档的 Sol 是承担最高性能的旗舰模型;Terra 是均衡处理日常工作的中档模型;Luna 则是以低成本处理大量任务的轻量模型。Sol、Terra、Luna 分别是拉丁语中的太阳、地球和月亮,命名方式经过重新梳理,数字(5.6)表示世代,名称表示性能档位。
用户可以根据是要优先保证精度、还是要压低成本,抑或取两者之间的平衡,从三款模型中挑选。预期的用法是:涉及复杂判断的工作交给 Sol,广泛的日常事务交给 Terra,而客服咨询等数量庞大的处理则交给 Luna。
编程效率与同竞争对手的比较
这次 OpenAI 特别强调的是编程场景下的效率。据首席执行官萨姆·奥尔特曼(Sam Altman)介绍,旗舰模型 Sol 在编程方面的令牌(token)效率比以往模型高出 54%。用更少的令牌完成同样的工作,不仅能加快响应速度,也更容易控制实际费用。
在性能方面,OpenAI 援引第三方指标「Artificial Analysis Coding Agent Index」称,Sol 取得 80 分,比 Anthropic 的顶级模型 Fable 5 高出 2.8 分。中档的 Terra 略胜 Fable 5,轻量的 Luna 也超过 Opus 4.8。OpenAI 声称,这些水平都是在使用更少令牌、成本更低的前提下达到的。
不过,这些都是 OpenAI 自己给出的比较。此次发布正值各家竞争对手接连推出新模型、争夺企业客户日趋激烈之际,实际使用体验仍有待独立评测和现场验证后再作判断。
OpenAI 还将 GPT-5.6 定位为「迄今最擅长网络安全的模型」。据称,它可以协助威胁建模、代码审查、编写补丁,以及模拟攻击以检验防御的蓝队演练等防守类工作。
同时推出办公新工具「ChatGPT Work」
配合模型系列的更新,OpenAI 还推出了面向企业团队的新工具 ChatGPT Work。它可以帮助处理起草文档、电子表格和演示文稿等日常事务,并可在桌面、网页和移动端使用。
此举透露出一种意图:把生成式 AI 从个人查资料、写文章的阶段,进一步延伸到嵌入团队层面的实际工作。
提供范围与价格
GPT-5.6 可通过 ChatGPT、编程助手 Codex 以及 OpenAI API 使用。开发者可通过 API 分别调用三档模型,根据任务的繁重程度切换模型。
API 价格按每 100 万令牌计费,各档之间差距很大。旗舰 Sol 输入 5 美元(约 810 日元)、输出 30 美元(约 4,860 日元);中档 Terra 输入 2.50 美元(约 400 日元)、输出 15 美元(约 2,430 日元);轻量 Luna 输入 1 美元(约 160 日元)、输出 6 美元(约 970 日元)。通过选择合适的档位,用户可以避免为超出需求的性能付费,从而优化成本。
※1 美元 = 162 日元(截至 2026 年 7 月 11 日)
总结
GPT-5.6 是一个分为旗舰 Sol、中档 Terra 和轻量 Luna 三档的新模型系列,让用户可以自行在性能与成本之间取得平衡。无论是编程令牌效率的提升、声称超越竞争对手的性能,还是辅助办公的「ChatGPT Work」的推出,此次发布都明显着眼于企业级实际应用。由于所示性能均基于 OpenAI 自己的比较,其真实实力还需通过今后的独立评测来验证。
