有消息称,Meta正在研发的下一代AI模型,性能已达到与OpenAI“GPT-5.5”相当的水平。据Business Insider报道,负责该公司超级智能部门的Alexandr Wang在一次内部全员大会上作出了上述表态。问题在于,这一说法所依据的基准测试并未公开,模型本身也仍处于训练之中。下面就现阶段已知的情况,梳理一下这一高调性能主张的具体内容。
“追平GPT-5.5”的说法究竟指什么
根据报道,Meta下一代模型(代号“Watermelon”)在被广泛关注的基准测试上已缩小了与GPT-5.5的差距。据称Wang在内部全员大会上向员工作了这一说明,两名知情人士向媒体透露了相关情况。
值得注意的是,他所指的究竟是哪些基准测试并未对外公布。既没有模型卡(汇总性能与训练条件的技术资料),也没有第三方的独立测量结果。现阶段外部无从核实,这只是公司内部的自我评估。鉴于AI行业屡次出现开发方公布的数值与外部机构测量结果不一致的情况,因此有必要等待模型公开与独立验证。Meta对该报道拒绝置评。
与前代“Avocado”的区别,以及高出一个数量级的算力
Watermelon仍在训练之中,尚未给出公开时间。关于它的一个特点是,据称其投入的算力比前代(代号“Avocado”)高出一个数量级。Avocado是Meta于今年4月以“Muse Spark”之名公开发布的模型,Watermelon则是其后续世代。
将算力提高一个数量级,绝非小幅增强。大规模模型的训练需要依次叠加多个阶段,从预训练(用海量数据搭建模型基础的工序)开始,再经过微调与强化学习;若大幅扩大规模,成本与训练所需时间都会相应膨胀。若这一说法属实,也可以视为一个信号——Meta在芯片和数据中心上持续投入的资金,终于开始转化为具有竞争力的成果。
巨额投资与人才争夺的背景
Meta今年预计在基础设施上投入最多1,450亿美元(约合23.5万亿日元)。即便如此,要让自家模型跻身行业最前沿,该公司一直颇为吃力。为扭转这一局面,CEO Mark Zuckerberg去年延揽了Wang,将重整研发的重任托付于他。
在延揽人才方面,Meta同样投入了巨额资金。据报道,该公司曾向顶尖研究者开出每人数亿美元(数百亿日元规模)的破格待遇,以将其招致麾下。正是在这样一个投资是否合理备受审视的节点上,出现了“已追平GPT-5.5”的内部评估。换个角度看,这也是在急于拿出成果的压力之下作出的表态,正因如此,对这一主张更应审慎看待。
※1美元=162日元换算(截至2026年7月6日)
比较对象本身也在移动
另一点不容忽视的是,比较的对手并没有停在原地。GPT-5.5是OpenAI今年4月公开的模型,而该公司上月底又推出了更强的“GPT-5.6”。后者部分出于美国政府的要求,目前尚未向公众广泛提供。
也就是说,Meta所谓“追上”的对手,其实已是上一代模型,而OpenAI当前的前沿高度还在更前方。前沿模型的研发,是一场刚追上、标准就随即移动的马拉松。即便Watermelon真的具备GPT-5.5级别的实力,也并不意味着它就与当下的最前沿并驾齐驱。
总结
“Watermelon追平GPT-5.5”的说法,一方面显示出Meta的巨额投资可能开始见效,另一方面在现阶段仍不过是公司内部的自我申报。基准测试内容未公开,模型仍在训练,公开时间也未定。作为比较对象的GPT-5.5也已是上一代。以破格待遇招揽研究者、每年维持万亿日元级投入的Meta,将以何种方式向外界展示其成果,仍有待观察。在实际的模型公开与第三方独立评估齐备之前,这一主张的真伪无从判断。
