AI初创公司Cohere于2026年9月16日宣布,已为其企业级AI推理平台「Model Vault」新增「机密计算(Confidential Computing)」功能。该功能对从用户输入提示词到模型生成回复的整个处理过程进行加密,使得Cohere自身也无法查看数据内容。
※缩略图为AI生成的示意图像。
继「静态存储」「传输」之后 「处理中」的数据也被加密
以往的云服务通常只在数据存储时(磁盘上)和传输时(网络链路上)进行加密,而AI模型实际执行推理运算时,数据在内存中往往仍以明文形式存在。Cohere此次新增的机密计算功能,正是为了填补这一「处理中」环节的空白。从用户输入的提示词到模型生成的回复,整个处理流程都在受硬件保护的隔离环境中完成,无论是Cohere的员工,还是运行Model Vault的云基础设施管理人员,都无法查看其中的内容。
同时「隔离」CPU与GPU
在技术层面,Cohere在CPU端采用Intel的「TDX」或AMD的「SEV-SNP」等机密计算虚拟机技术,同时让NVIDIA GPU以机密计算模式运行。CPU与GPU之间的通信链路本身也通过基于SPDM(一种用于验证通信对象身份的行业标准协议)的安全会话进行加密,解密密钥仅在负责处理的处理器内部生成,不会向外部软件或基础设施管理人员泄露。用户端也通过名为「Oblivious HTTP(OHTTP)」的方式,将请求直接加密发送至该受保护环境,因此密钥不会经过Cohere自身的系统。
处理内容是否真正受到保护,用户可以自行验证。Cohere在每次推理时都会出具一份「远程认证(Remote Attestation)」报告,证明运行环境确为正规的机密计算硬件,并说明所加载的固件、代码与配置信息,验证服务采用的是Intel的「Intel Trust Authority」。此外,Cohere还表示计划将Model Vault的服务端基础架构(实际处理推理请求的软件整体)开源,以便外部审计人员能够独立验证其实现方式。
面向银行、医院、政府机构等受监管行业
Cohere表示,该功能的目标客户包括银行、医院、政府机构等处理受监管数据或高度敏感信息、需要独立于其他租户的「单租户」部署以及厂商签名认证证明的组织。随着生成式AI在企业核心业务中的应用不断扩大,「不希望连云服务商都能看到自己的数据」这一需求也在增强,这被认为是此次功能推出的背景之一。据Cohere推理团队负责人Manoj Govindassamy介绍,现有Model Vault用户可免费使用该功能,无需额外付费。
总结
Cohere为「Model Vault」新增了机密计算功能,在静态存储和传输加密的基础上,进一步覆盖了处理中的数据加密。该方案结合了Intel TDX或AMD SEV-SNP与NVIDIA GPU的机密计算模式,并配备远程认证机制用于验证,未来还计划开源相关服务端架构。该功能面向现有用户免费开放,也体现出以受监管行业为中心的企业AI应用正日益重视可验证的「数据主权」这一趋势。
