当地时间 7 月 9 日,OpenAI 发布了最新旗舰模型「GPT-5.6」,并宣布该模型将成为 Microsoft 365 Copilot 的首选模型(preferred model)[1]。这款最新模型将被集成到 Word、Excel、PowerPoint、Copilot Chat 和 Cowork 等日常办公工具中,有望提升文档撰写与数据分析的质量。
Copilot 的「首选模型」采用 GPT-5.6
根据此次公告,GPT-5.6 将作为新的首选模型,应用于 Microsoft 365 Copilot 的 Word、Excel、PowerPoint、Copilot Chat 和 Cowork 各款应用[1]。Microsoft 365 用户可以在自己每天惯用的工具中,获得 OpenAI 最新模型的辅助。
提供方式也颇具特点。微软除了在自家服务中原生提供 GPT-5.6 外,还会通过直接调用 OpenAI 的 API,把该模型交付给 Microsoft 365 的客户[1]。微软 Copilot 与智能体核心部门总裁 Nitin Agrawal 表示,从起草文档、分析数据到制作演示文稿,用户都将能够产出更加精致的成果[1]。
各款应用会有哪些变化
OpenAI 表示,借助 GPT-5.6,各款应用可望实现以下改进[1]。
在 Word 中,用户可以用更少的往复交互完成文档的起草、编辑与润色。在 Excel 中,模型在高效使用 token 的同时支持更深入的分析,缩短从数据到洞察的时间。在 PowerPoint 中,可以在减少细致指令的情况下,把初步创意转化为视觉上更整洁的演示文稿。在协作工具 Cowork 中,则能够在减少手动协调的同时,把跨部门的复杂工作整理成高质量的成果。
这些改进都指向同一个方向——「以更少的精力获得更好的成果」,正体现了 GPT-5.6「让每个 token 产出更多有用工作量」的设计理念[1]。
GPT-5.6 是怎样的模型
GPT-5.6 是 OpenAI 于 7 月 9 日推出的最新模型家族。它采用三层阵容:定位最高端的「Sol」,以及更轻量、更注重成本效率的「Terra」和「Luna」,用同一个系列覆盖从旗舰任务到大批量处理的各种需求[2]。
根据 OpenAI 自己公布的数据,在评估横跨 55 个领域长时程智能体工作的基准测试「Agents' Last Exam」中,GPT-5.6 Sol 创下 53.6 的历史新高,比 Anthropic 的「Claude Fable 5」(自适应推理)高出 13.1 分。在中等推理设置下,它仍以约四分之一的估算成本领先 Fable 5 达 11.4 分;较低层级的 Terra 和 Luna 也以约十六分之一的估算成本,表现优于 Fable 5[2]。由于这些均为 OpenAI 自行公布的数值,仍有待第三方进一步验证。
微妙时期的「蜜月」宣示
此次发布也正值围绕两家公司关系的报道不断之际。多家国际媒体称,微软出于成本管理考虑,正在为 Microsoft 365 打造自研 AI 模型(MAI)。有观点指出,「首选模型」这一较为克制的措辞,为两种情形同时成立留出了空间:OpenAI 的模型可以保住这一位置,同时微软也在并行推进自研模型[3]。
在此类观测扩散之际,OpenAI 的 API 产品负责人 Nikunj Handa 强调了双方合作关系的延续,他表示「Microsoft 365 是数百万人每天写作、分析、创作与协作的地方」[1]。此次把首选模型的定位摆到台前,也可以解读为传递出合作关系依然稳固的信号。
总结
OpenAI 的最新模型 GPT-5.6 将作为首选模型集成到 Microsoft 365 Copilot 的 Word、Excel、PowerPoint、Copilot Chat 和 Cowork 中。凭借注重 token 效率的设计,它力求在日常办公工具中实现「以更少精力获得高质量成果」。在微软自研模型报道频出的微妙时期,这也是一条值得关注的新闻——包括两家公司关系的走向。
出典:https://openai.com/index/gpt-5-6-preferred-model-microsoft-365-copilot
