产品动态2 分钟读完NVIDIA Blog

NVIDIA 发布 Groq 3 LPX 正式投产,Vera Rubin 平台扩展 AI 推理

速览

NVIDIA 宣布其新一代 AI 推理系统 Groq 3 LPX 已全面投产,并集成于 Vera Rubin 机架级平台。该平台在长上下文 Agent 任务中,AI 输出速度达到每秒 3,400 个 token,是替代方案的 4 倍。目前,CoreWeave 和 Nebius 等云服务商已开始部署,标志着急需高吞吐、低延迟的 Agentic AI 应用有了新选择。

NVIDIA 于 8 月 24 日宣布其应用于机架级系统的 Groq 3 LPX 推理加速器已全面投产。这套系统与 Vera Rubin NVL72 平台集成,旨在应对 AI Agent 在长序列推理时对 token 生成速度的严苛要求。在面向开源 Agent 模型 Gemma 4 31B 的基准测试中,该系统实现了每秒 3,400 个 token 的输出速度,处理 10 万 token 的上下文时,其速度是最近似竞品平台的 4 倍。

NVIDIA 已确定多家合作伙伴。其中,CoreWeave 正在生产环境中部署 Spectrum-X Multiplane 网络,该网络通过多级并行交换机来连接 Vera Rubin 机架,以构建高带宽、低损耗的 AI 网络;Nebius 则成为首个采用 Groq 3 LPX 的 AI 云服务商。此外,SpaceXAI 也宣布将采用 Vera CPU 来支持其 Agent 相关的调度、代码执行等工作。

原文With Groq 3 LPX in Full Production, NVIDIA Extends Vera Rubin Inference for Agentsblogs.nvidia.com

#英伟达#推理#芯片

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。