推理吞吐量提升 4.8 倍:CoreWeave 推出 Vera Rubin 与 Forge 应对代理式 AI 挑战
CoreWeave 联合 NVIDIA 发布 Vera Rubin NVL72、Vera CPU 及 Forge 平台。新硬件在代理式 AI 推理与沙箱并发上实现数倍性能提升,Forge 平台则打通了生产数据到训练的反馈闭环,共同解决代理式 AI 部署的基础设施瓶颈。
SEARCH INTELLIGENCE
从最新动态到实用工具,找到你关心的内容。
CoreWeave 联合 NVIDIA 发布 Vera Rubin NVL72、Vera CPU 及 Forge 平台。新硬件在代理式 AI 推理与沙箱并发上实现数倍性能提升,Forge 平台则打通了生产数据到训练的反馈闭环,共同解决代理式 AI 部署的基础设施瓶颈。
2026年9月23日,Supermicro 宣布启动英伟达 Vera Rubin NVL72 机架系统出货。该方案包含液冷算力机架等完整数据中心构建模块,云端服务商 CoreWeave 已正式上线基于该架构的多机架集群。
MLPerf Inference v6.1 最新测试结果显示,AMD 凭借 512 个 MI355X 集群在 DeepSeek R1 推理总吞吐量上超越英伟达 288 卡 GB300 配置;同时,英伟达下一代 Vera Rubin 架构首次现身,其 72 GPU 配置性能较 GB300 提升 95%。
Anthropic 已同意向西弗吉尼亚州 Nscale 旗舰数据中心支付 450 亿美元,租用为期六年的 AI 云计算算力。该承诺对应约 460 兆瓦电力容量,将使用 Nvidia Vera Rubin 芯片,是 Anthropic 在 IPO 前锁定算力产能的关键动作。
总部位于海得拉巴的 AM Intelligence 宣布订购 9000 套英伟达 Vera Rubin 系统,目标成为亚洲最早采用该平台的厂商之一,相关服务器计划于 2027 年在印度南部上线,面向云厂商、AI 实验室及本土 AI 模型开发方提供算力。
NVIDIA 机架级推理系统 Groq 3 LPX 已全面投产,在 10 万 token 长上下文下运行 Gemma 4 31B 达每秒 3400 输出 token,Nebius 成为首家采用该平台的 AI 云。
英伟达已通知部分最大客户,搭载其AI芯片的服务器价格将上涨超过15%,主要受内存芯片成本飙升驱动,新价格将于明年初发货的系统中生效,涨幅因芯片代际和内存配置而异。