被Wix收购的氛围编程(通过自然语言指令构建应用的方式)平台Base44,已开始提供自主研发的AI模型「Base1」。此举意味着该公司将重心从此前依赖的第三方通用大语言模型(LLM),转向用自家积累的海量使用数据训练出的专精模型。通过针对自身用途优化响应速度、成本以及所生成应用的质量,Base44意在巩固自己作为AI初创公司的竞争优势。

用自家数据打磨的专精模型「Base1」

Base44是一家总部位于以色列特拉维夫的初创公司,约一年前被Wix以8000万美元(约130亿日元)收购。收购时该公司成立仅约半年,团队只有8人。此后它快速成长,如今已发展到拥有自研模型的阶段。

Base1是在现有开源LLM的基础上,针对Web应用开发这一用途进行微调(fine-tuning)而成的模型。据称其训练使用了从平台上真实发生的数千万次用户操作中生成的数据集。在方法上,它以强化学习为核心,让模型反复处理真实的应用构建与编辑任务,判定输出的好坏,再将结果反馈到模型权重中反复打磨。

创始人Maor Shlomo表示,将模型作为整个技术栈的一部分自行训练并拥有,能够在响应速度、成本和效率方面更方便地进行深入优化。他认为通用模型今后仍会持续进步,但终究会停留在应对广泛用途的方向上,而专注于特定用途的专精模型才更有胜算。他希望最终能比使用Opus这类前沿模型(最先进的超大型模型)更快、更便宜地把成果交付给用户。

关键在于「防御力」:把数据、分发与基础设施圈进来

这一决定的背后,是关于AI初创公司「防御力」的激烈讨论:如果只是骑在别人的模型之上搭建业务,长期来看会不会轻易被竞争对手赶超,这是一种深层的担忧。

风险投资机构Headline的普通合伙人Jonathan Userovici指出,AI初创公司要筑牢防线,有三大要素:数据、分发(把产品送到用户手中的渠道)以及技术基础设施。他的判断是,品牌越强的公司越是在深挖自家数据和基础设施,构建竞争对手难以复制的状态,而Base44进军自研模型正处在这一趋势的延长线上。事实上,Shlomo表示希望把Base44打造成一家同时掌握分发、数据和基础设施的「唯一垂直整合的氛围编程公司」。

不过,竞争对手并不只有同类的氛围编程初创公司。除了依赖外部LLM的瑞典公司Lovable这样的直接竞争者外,最前沿的研究机构本身也在逼近。拥有Grok的xAI与Cursor都已归入SpaceX旗下,Anthropic的Claude Code也成长为氛围编程领域中独当一面的角色。它们都是掌握着海量使用数据与良性反馈循环的强大存在。

与此同时,也有人谨慎地指出,自研模型这条路并非万能。Userovici以放弃自研模型计划的法律科技公司Harvey为例,提醒人们不要低估前沿模型的实力。他并不认为应用领域的AI公司会大规模地转变为研究机构,而是把这一动向放在更宏观的背景下理解:推理(运行模型得出答案的处理)成本的分量正变得越来越重,正是这一点在推动此类举措。

持续成长的Base44,也期待改善成本结构

Base44的业务表现良好。该公司宣布,其年度经常性收入(ARR)在5月突破了1.5亿美元(约240亿日元),距离跨过1亿美元(约160亿日元)仅过去两个月。虽然还不及竞争对手Lovable本月宣称达到的5亿美元(约800亿日元)ARR,但收购之后它一直在增员的同时保持增长。这与母公司Wix近期宣布裁减两成员工形成鲜明对比。

※按1美元=162日元换算(截至2026年7月2日)

成本方面的效果不会立刻体现在数字上。即便如此,该公司预计,通过自己拥有模型,就能直接掌控计算资源与推理相关的支出,从而随着时间推移强化利润率的结构本身。据称Base1的开发耗费了相当大的工程投入,但Shlomo认为,正是这笔投资构成了确立垂直整合定位的基石。

总结

Base44的自研模型「Base1」,是一步意在摆脱「只是骑在通用外部模型之上」的业务模式的棋。通过用自家数据打磨专精模型,针对特定用途磨炼速度、成本与质量,该公司试图建立竞争对手难以追随的优势。在前沿模型不断进步、推理成本分量日增的当下,这或将成为衡量应用领域AI公司自研化会走多远的试金石。