
随着企业AI重心从训练转向推理,专用云服务商CoreWeave正凭借定制化基础设施迅速崛起。该公司近日宣布,已在CoreWeave Cloud上完成英伟达Vera Rubin NVL72系统的首次上线与验证,引发行业关注。
研究显示,86%的企业将数据统一置于计算能力之上,证实AI性能不仅取决于加速器。CoreWeave对Nvidia Vera Rubin的支持,旨在构建一个支持智能体AI的统一综合平台,回应了这一市场需求。
从获取算力到全栈运营
推理已成为企业兑现AI投资回报的关键领域。CoreWeave试图通过基础设施栈各层面的专业知识,在竞争中脱颖而出。
分析指出,随着智能体AI和推理工作负载扩展,企业需要支持可扩展部署、可观测性、安全性及成本管理的全生命周期基础设施。新云服务商的角色日益重要,但其长期优势取决于能否将基础设施性能与应用成果有效连接。
CoreWeave定位其专用堆栈以提供更高利用率、更快容量访问及更优Token经济性。数据显示,约30%的组织面临AI实验与生产间的运营就绪差距,近88%的AI试点项目未能投产。CoreWeave通过与英伟达全栈平台合作,旨在缩小这一差距,推动行业从孤立组件向集成化、面向生产的AI系统转变。
Vera Rubin解锁智能体时代
验证Vera Rubin是CoreWeave的重要里程碑。分析师强调,该平台最显著的商业影响在于成本压缩,其每百万Token成本仅为英伟达此前发布产品的十分之一。这不仅降低支出,更可能通过改善Token经济性扩大市场。
业界观点认为,AI竞争已从孤立模型转向整合计算、网络、存储、软件及安全的系统级较量。全栈平台如Vera Rubin通过紧密连接模型与数据系统,实现更低延迟和更快推理反馈,成为降低成本的关键。
CoreWeave首席营销官Jean English表示,市场对高可靠性AI基础设施需求巨大,许多客户因其他方案缺乏稳定性而转向CoreWeave。率先上线并验证Vera Rubin,构成了其服务的核心差异化优势。
CoreWeave首席技术官Peter Salanki展望,未来推理将分解为专业化管道:小模型处理初步查询,大模型接管复杂任务,以平衡性能与成本。英伟达高管Dion Harris也指出,Vera Rubin专为智能体构建,通过汇聚CPU、GPU和存储,启用具备规划能力和子代理的新型工作流。
千亿订单积压挑战超大规模运营商
截至6月30日,CoreWeave的收入积压约为1040亿美元,代表尚未确认的合同收入。公司今年还推出了允许企业使用真实数据自主改进AI智能体的新服务,以及物理AI现场工程服务。
庞大的订单积压反映了CoreWeave的快速成长。分析人士指出,“轻资产”趋势促使企业寻求无需巨额资本支出即可获取AI智能的途径,CoreWeave因此受益。
CoreWeave押注推理需求上升将强化专用AI云的优势。为此,公司重新设计了设施、机柜及软件控制平面。Vera Rubin机柜单机架功率高达250千瓦,使得液冷等专用技术成为支持高密度基础设施的关键。
CoreWeave产品和工程执行副总裁Chen Goldberg强调,智能体时代要求基础设施适应持续推理和不可预测的扩展,实验室与生产环境的区别在于背后的工程深度。