Groq 宣布完成 3.5 亿美元 A 轮融资,估值达 35 亿美元。公司已停止自研 LPU 芯片,全面转型为基于 NVIDIA GPU 的 Neocloud 服务商,并计划将数据中心总功率提升至 200MW 以上。
Groq 宣布完成 3.5 亿美元 A 轮融资,估值达 35 亿美元。公司已停止自研 LPU 芯片,全面转型为基于 NVIDIA GPU 的 Neocloud 服务商,并计划将数据中心总功率提升至 200MW 以上。
CME 计划于 2026 年 10 月 5 日推出首批与 NVIDIA H100 和 B200 GPU 租赁价格挂钩的期货合约,算力正式迈向标准化、可交易的金融资产。
IBM 宣布与 Together AI 达成 2.4 亿美元多年期协议,将在 IBM Cloud 部署首个基于 NVIDIA HGX B300 与 Spectrum-X 以太网技术的推理专用集群,预计 2027 年第一季度上线,用于支持 Together AI 的开源模型推理服务。
NVIDIA 发布开源模型 Nemotron 3.5 Lightning 及路由库 NeMo Switchyard。前者以 3.6B 激活参数实现 670 tokens/秒输出,后者通过规划与执行分层路由,可将智能体任务成本降至 Opus 4.8 单独运行的近三分之一。
Firebird于2026年8月8日在亚美尼亚赫拉兹丹启动独联体最大AI工厂,并宣布NVIDIA计划对其进行直接投资。工厂基于NVIDIA DSX平台构建,首阶段搭载B200 Blackwell GPU,目标到2027年底部署超7万枚GPU并建成300兆瓦容量。
xAI宣布完成20亿美元E轮融资,创下2026年全球人工智能领域单轮融资最高纪录。此前融资推动公司在通用人工智能领域的战略发展,巩固其在资本市场的地位。
NVIDIA在拉斯维加斯国际消费电子展上揭晓了包含六款协同设计芯片的Rubin AI计算平台。该平台显著提升AI硬件性能,降低训练和推理成本,加速人工智能技术普及。
法国人工智能初创企业Mistral AI揭晓了Mistral 3系列模型,包括旗舰级Mistral Large 3和九款小型Ministral 3变体。NVIDIA与Mistral AI合作构建端到端计算基础设施,并计划建立欧洲最大AI园区。
微软Azure正式推出NDv6 GB300虚拟机系列,标志着全球首个大规模NVIDIA GB300 NVL72 AI超算集群投入生产。该系统由超过4,600台NVIDIA Blackwell Ultra GPU构成,专为OpenAI尖端推理任务设计,提供每虚拟机1.44 exaflops的FP4张量核心算力。
NVIDIA在CES 2025发布多项AI技术,包括NVIDIA NIM微服务和AI Blueprint,结合全新GeForce RTX 50系列GPU,为生成式AI应用提供强大性能支持。NVIDIA还宣布推出专为AI开发设计的RTX AI PC,加速PC平台的AI技术普及。