OpenAI 于美国时间 6 月 26 日宣布,开始对新一代大语言模型系列「GPT-5.6」进行限量预览[1]。该系列由三款机型组成:旗舰级的「Sol」、面向日常工作并兼顾平衡的「Terra」,以及高速低价的「Luna」。目前先通过 API 和 Codex 向部分合作伙伴提供。OpenAI 表示,新机型在编程、生物学和网络安全领域提升了性能,同时也配套了迄今为止最为稳健的安全机制。

三款机型「Sol」「Terra」「Luna」

GPT-5.6 由三款可按任务选择的机型构成。旗舰级的「Sol」面向最棘手的难题,定位于复杂编程和安全研究。「Terra」是面向日常工作的中端机型,OpenAI 称其在保持与上一代 GPT-5.5 相当性能的同时,价格压低了一半。「Luna」则是速度最快、成本最低的机型,适合摘要、起草以及常规自动化等较轻量的处理[1]。

配合此次发布,命名规则也进行了梳理。数字(5.6)表示世代,而 Sol、Terra、Luna 表示能力档位。由于各档位可以按各自的节奏演进,用户能够更容易地在智能、速度与成本的平衡中做出选择。

在功能方面,OpenAI 为 Sol 新增了让其更长时间深入推理的「max」设置,还引入了利用多个子代理来分担并加速复杂工作的「ultra」模式[1]。

性能在编程、生物学与网络安全领域提升

OpenAI 在发布的同时公开了部分评测结果。在编程工作方面,公司称 GPT-5.6 Sol 在需要规划、迭代和工具协同的命令行操作基准「Terminal-Bench 2.1」上创下了最高水平。在生物学领域,Sol 在衡量长流程基因组分析和定量生物学任务的「GeneBench v1」上,以更少的 token 用量取得了优于 GPT-5.5 的结果[1]。

在网络安全方面,OpenAI 表示提升了漏洞研究、漏洞利用等长流程任务的性能与效率。在基准「ExploitBench」上,Sol 在将输出 token 量压缩至约三分之一的同时,达到了可与现有模型「Mythos Preview」相竞争的水平。与此同时,OpenAI 明确表示,Sol 并未越过其安全评估指南「Preparedness Framework」中的「Cyber Critical(网络领域被认定为特别危险的水平)」阈值。在使用 Chromium 和 Firefox 的测试中,Sol 找到了构成攻击的漏洞与线索,但在测试条件下并未自主生成完整的攻击[1]。

迄今最稳健的安全机制与分阶段发布

GPT-5.6 随附了 OpenAI 称为迄今最稳健的安全机制。它采用「多层防御」结构,叠加了内置于模型中的拒绝机制、在生成过程中检查输出的实时分类器、账户层面的审查以及差异化的访问控制。OpenAI 称,为找出具有普适性的越狱(jailbreak)手法,公司向自动红队投入了相当于 70 万 A100 的 GPU 小时[1]。

此次预览还有与美国政府协调的背景。OpenAI 表示,在发布之前向美国政府分享了模型的能力与计划,并应政府要求,先从已向政府告知参与情况的少数可信合作伙伴开始提供。公司同时表示,这种由政府进行访问确认的框架不应成为长期的默认做法,并提及了工具难以送达有需要的用户、开发者与防御方的担忧[2]。OpenAI 称,在预览期间,即便是正当的工作,安全机制也可能介入,导致响应延迟或被拒绝,并表示将持续检验这一行为[1]。

价格、访问与提供方式

GPT-5.6 的价格按输入、输出分别以每 100 万 token 计。Sol 为输入 5 美元(约 810 日元)/输出 30 美元(约 4,860 日元),Terra 为输入 2.50 美元(约 405 日元)/输出 15 美元(约 2,430 日元),Luna 为输入 1 美元(约 162 日元)/输出 6 美元(约 972 日元)[1]。※按 1 美元 = 162 日元换算(截至 2026 年 6 月)

此外,重复利用已处理输入的提示缓存(prompt caching)也进行了调整。现支持显式的缓存断点,并引入了最短 30 分钟的缓存保留时间。写入缓存按常规输入单价的 1.25 倍计费,而从缓存读取则继续享受 90% 的折扣[1]。

在提供方面,预览期间将通过 API 和 Codex,向部分可信的合作伙伴及机构提供。目前在 ChatGPT 中尚不可用,但 OpenAI 表示计划在数周内于 ChatGPT、Codex 和 API 上广泛提供。此外,公司还计划在 7 月开始在半导体企业 Cerebras 的平台上以每秒最高 750 token 的速度运行 Sol[1]。

总结

OpenAI 公开的「GPT-5.6」是由旗舰级 Sol、中端 Terra 和低成本 Luna 三档构成、在编程·生物学·网络安全领域提升了性能的新一代模型系列。公司在能力提升的同时强化了多层安全机制,并在与美国政府协调之后,先以限量预览这一谨慎方式开始提供。在 ChatGPT 上的全面提供预计将在数周后,随着各家 AI 公司之间竞争的持续,其实际使用体验与安全性将如何被评价,将成为下一个焦点。

出典:https://openai.com/index/previewing-gpt-5-6-sol

出典:https://www.cnbc.com/2026/06/26/openai-limits-new-ai-models-to-trusted-partners-request-us-government.html