AI基础设施企业Crusoe与AI搜索服务商Perplexity宣布达成多年期合作。此次合作涵盖AI服务从模型训练到生产环境推理的完整周期,双方将各自的核心优势结合起来,共同深化这一合作关系。
训练与推理一站式完成
此次合作的核心是Crusoe提供的搭载NVIDIA GB300 NVL72的专用集群。借助配备NVIDIA InfiniBand高速互联技术的这些集群,Perplexity将在其上训练前沿模型。训练完成后,模型将直接接入Crusoe的"Managed Inference"推理服务,用于生产环境中的实时响应。无需再从不同供应商分别采购和管理训练与推理基础设施,这是本次合作的一大特点。
当"速度"本身就是产品
对Perplexity而言,推理速度与稳定性至关重要。该公司的AI搜索服务据称每月处理超过15亿次提问,任何响应延迟都会直接影响用户体验。与传统搜索引擎不同,Perplexity的答案生成需要进行大规模实时计算,因此延迟和吞吐量已不仅仅是技术指标,而是直接决定产品质量的关键因素。
Crusoe定位为"全栈式"AI基础设施企业
Crusoe将自身定位为垂直整合的AI基础设施提供商,业务范围从硬件采购、数据中心运营一直延伸到推理服务。与传统云服务商不同,该公司从电力采购、数据中心建设到GPU集群搭建均由自己一手完成。在此次合作中,Crusoe还将为其约1800名员工引入Perplexity的企业版方案"Enterprise Pro"和"Max",从基础设施供给与产品使用两个层面深化双方关系。双方均未公开此次合作的具体金额或计算资源规模。
AI专业基础设施企业的影响力持续扩大
随着生成式AI需求不断增长,GPU集群的采购竞争日趋激烈。除大型云服务商外,像Crusoe这样将电力、设施与GPU运营整合为一体的专业基础设施企业,正日益成为AI企业的有力选择。模型训练与生产运行对基础设施的要求各不相同,要同时在两方面都做到高水准并不容易。像本次这样"训练到推理由同一套基础设施承担"的合作模式,为AI服务企业减轻基础设施采购与运维负担、将更多资源投入到提升响应速度与稳定性上,提供了一种可行方案。
总结
Crusoe与Perplexity的此次合作,是将模型训练与推理这两个特性迥异的环节,整合到同一基础设施平台上的一次尝试。Perplexity有望提升其每月处理约15亿次查询的搜索服务的响应性能,而Crusoe则借此获得了验证自身基础设施实力的案例。随着生成式AI应用的持续扩大,基础设施专业企业与AI服务企业之间以这种方式加深相互依存关系的趋势,预计今后还将进一步增多。
