NVIDIA 与 CoreWeave 联手打造智能体 AI 闭环:下一代云基础设施如何重塑自主智能

Published · AI Daily — AI-assisted deep research, methodology & disclosure

经过近十年联合工程,CoreWeave 将 NVIDIA 的计算、网络与软件整合为专为 AI 设计的云平台,并在多代硬件迭代中持续获得投资回报。如今,双方将基于 Vera Rubin 架构的下一代基础设施投入生产,专门用于智能体 AI 工作负载,实现从模型训练到自主推理与行动的完整闭环。这一合作不仅标志着 AI 云服务从通用计算向智能体优化的关键转折,也将对云市场竞争格局、企业 AI 部署模式以及 NVIDIA 的生态壁垒产生深远影响。

NVIDIA 与 CoreWeave 近日宣布,双方基于近十年的深度联合工程,正式将下一代 NVIDIA 基础设施投入生产,专门用于智能体 AI 工作负载,从而完成从训练、推理到自主行动的完整闭环。这一合作并非突然之举,而是建立在 CoreWeave 多年持续部署 NVIDIA 多代 GPU 架构并实现正向投资回报的基础之上。从早期的 Pascal、Volta 到 Ampere、Hopper,再到即将大规模上线的 Vera Rubin 架构,CoreWeave 一直作为 NVIDIA 全栈解决方案的忠实实践者,将 NVIDIA 的计算加速卡、高速网络(如 InfiniBand 和 Spectrum-X)以及软件堆栈(CUDA、AI Enterprise、Omniverse 等)深度整合,构建起一个专为 AI 原生工作负载优化的云平台。此次升级的核心是将智能体 AI 所需的高吞吐量推理、低延迟交互、多模态处理以及强化学习反馈循环等能力,通过预配置的集群和软件层直接交付给客户,使得企业能够更快地将具备自主规划与工具调用能力的 AI 智能体投入生产环境。

从技术原理看,智能体 AI 与传统 AI 推理存在本质区别。传统推理往往是单次请求-响应模式,模型接收输入并生成输出即结束;而智能体 AI 则需要模型在开放环境中持续感知、规划、执行动作并观察结果,形成多步决策循环,这对基础设施提出了全新要求。首先,推理延迟必须极低,因为智能体每一步决策都可能触发工具调用或环境交互,延迟累积会严重拖慢任务完成速度。其次,系统需要支持高并发、长连接的会话状态管理,因为智能体任务可能持续数分钟甚至数小时。再者,智能体经常需要同时处理文本、图像、代码等多种模态信息,并要求模型具备动态切换上下文的能力。CoreWeave 的 AI 云正是针对这些需求进行了垂直优化:通过 NVIDIA 的 NVLink 和 NVSwitch 实现 GPU 间高速互联,减少多卡推理的通信瓶颈;利用 InfiniBand 网络构建无阻塞的胖树拓扑,确保大规模集群内任意节点间的高带宽、低延迟通信;在软件层面,结合 NVIDIA Triton 推理服务器和 TensorRT-LLM 等工具,对 Transformer 模型进行算子融合和量化加速,并针对智能体常见的思维链推理和工具调用模式进行调度优化。商业上,CoreWeave 的定价模式也区别于传统云厂商的按需实例,它提供预留容量和长期合约,帮助客户锁定算力成本,这对于需要稳定大规模推理的智能体应用尤为重要。NVIDIA 则通过 CoreWeave 这样的专业伙伴,将自身硬件和软件栈以更贴近应用场景的方式输出,形成从芯片设计到云服务的垂直整合,强化了其在 AI 基础设施领域的护城河。

这一合作对行业格局的影响是多维度的。首先,在 AI 云服务市场,CoreWeave 的崛起直接挑战了 AWS、Azure 和 Google Cloud 等通用云巨头的地位。传统云厂商虽然也提供 GPU 实例,但其基础设施并非为 AI 原生设计,网络架构、存储系统和虚拟化层往往成为性能瓶颈,且软件优化通常滞后。CoreWeave 则从底层硬件到上层调度全部围绕 AI 工作负载定制,能够提供更高的性价比和更快的迭代速度。这使得越来越多的 AI 初创公司和大型企业将其核心训练和推理任务迁移到 CoreWeave 上,迫使传统云厂商加速推出类似的专用 AI 云服务,例如 AWS 的 Trainium 和 Inferentia 芯片、Google 的 TPU v5 等,但短期内仍难以撼动 NVIDIA 软件生态的粘性。其次,对于企业用户而言,智能体 AI 的落地门槛被显著降低。过去,企业若要部署一个能够自主执行复杂任务的智能体,需要自行搭建异构计算集群、调优网络和推理引擎,耗时耗力且效果难以保证。现在,通过 CoreWeave 提供的预优化环境,企业可以专注于模型开发和业务逻辑,将基础设施的复杂性外包,从而加速智能体在金融分析、药物研发、工业自动化等领域的应用。此外,NVIDIA 与 CoreWeave 的深度绑定也向市场传递了一个信号:AI 基础设施的竞争正从单点硬件性能转向全栈系统优化和生态锁定。NVIDIA 不仅提供芯片,还通过 CUDA、AI Enterprise 和 Omniverse 等软件平台构建了强大的开发者生态,而 CoreWeave 作为其云化出口,进一步放大了这一生态的覆盖范围。竞争对手如 AMD 和 Intel 虽然在硬件参数上逐步追赶,但缺乏同等成熟的软件栈和云服务伙伴,短期内难以突破。

展望未来,有几个关键信号值得持续关注。第一,Vera Rubin 架构的具体性能表现和能效比将直接影响智能体 AI 的规模化成本。如果该架构在推理吞吐量和内存带宽上实现代际飞跃,可能会催生更复杂的智能体应用,例如长时间自主运行的科研助手或全自动代码生成与调试系统。第二,CoreWeave 的客户结构和应用案例将揭示智能体 AI 的真实落地速度。目前已知其客户包括多家头部 AI 实验室和大型企业,但具体在哪些垂直场景中智能体率先实现商业闭环,将决定这一技术浪潮的扩散节奏。第三,NVIDIA 是否会进一步扩大与 CoreWeave 的独家合作深度,或者将类似模式复制到其他区域性云服务商,这将影响全球 AI 算力供给的分布和定价权。第四,监管层面对大规模 AI 算力的态度变化也值得警惕,若各国对智能体自主决策能力施加限制,可能会影响相关基础设施的部署节奏。总体而言,NVIDIA 与 CoreWeave 此次完成的智能体 AI 闭环,不仅是技术架构的升级,更是一次商业模式的验证,它预示着 AI 基础设施正在从通用计算时代全面迈入自主智能时代,而掌握全栈优化能力的玩家将定义下一阶段的竞争规则。

Sources

FAQ

NVIDIA 与 CoreWeave 的合作内容是什么?

双方基于近十年联合工程,将下一代 NVIDIA 基础设施投入生产,用于智能体 AI,实现从训练到自主行动的闭环。

这一合作对 AI 行业有何影响?

它标志着 AI 云服务从通用计算转向智能体优化,降低企业部署自主 AI 的门槛,并通过垂直整合挑战传统云巨头。

未来应关注哪些关键信号?

关注 Vera Rubin 架构性能、智能体 AI 实际落地案例、NVIDIA 合作模式扩展,以及监管对自主 AI 的回应。