英伟达(NVIDIA)在 Hot Chips 大会上宣布,旗下 AI 推理加速机柜 Groq 3 LPX 已进入量产阶段,由三星电子(Samsung Electronics)采用 4 纳米制程代工。AI 云服务商 Nebius 作为首位客户,将率先整合进入其推理平台并对外提供服务。此次量产标志着英伟达继 Grace Blackwell 世代之后,Vera Rubin 平台在 AI 代理浪潮中最具话题性的产品正式落地。
Groq 3 LPX 是什么?Vera Rubin 平台的推理加速补丁
Groq 3 LPX 的核心定位,是基于 Nvidia Vera Rubin NVL72 系统、专为优化 AI 代理推理速度而生的加速器。NVL72 负责模型训练与通用推理,而 Groq 3 LPX 则专攻「token 生成速度」。
硬件架构上,Groq 3 LPX 是一套内置 256 颗 LPU(语言处理器)的机架系统,LPU 是英伟达去年底间接收购 Groq 半导体公司后,取得的核心推理专用芯片技术。在 Artificial Analysis 的基准测试中,Groq 3 LPX 以 Gemma 4 31B 开源代理模型搭配 100,000 token 的上下文长度执行,达到每秒 3,400 个 output token,是该模型的全球最高纪录。
相较于市面上其他替代平台,Groq 3 LPX 的推理响应速度快 4 倍,能让 AI 代理在几分钟内就完成程序编写等复杂任务。
对 AI 代理系统来说,这个优势特别重要:一个 AI 代理从检查档案、编写代码、调用外部工具、验证结果到反复迭代往往需耗费数小时;此时 token 生成速度的快慢,将决定整个用户体验能否保持流畅且高效。
量产细节上,Groq 3 LPX 100% 交由三星电子旗下的晶圆代工部门(Samsung Foundry)制造,生产地点为三星位于韩国京畿道的平泽园区,制程节点为 4 纳米。
在台积电(TSMC)近乎垄断高阶 AI 芯片代工市场的当下,英伟达选择三星代工 Groq 3 LPX 也格外引发关注。三星 4 纳米制程近期陆续吸引多家全球客户,此次拿下英伟达量产订单,对三星晶圆代工业务再次具有象征意义,也意味着三星在 AI 芯片代工领域的竞争地位正在复苏。
Nebius、Groq 抢头香,Vera Rubin 打造全方位 AI 工厂
首批客户阵容也浮出水面,分别是英伟达重点扶持的 Nebius 与 AI 云端公司 Groq,前者预计通过其旗下的 Nebius Token Factory 推理平台,率先将 Groq 3 LPX 导入生产环境,让开发者可通过现有 API 直接访问超高速 token 生成能力,无需迁移技术栈。
Nebius 首席技术官 Danila Shtan 表示,Groq 3 LPX 正是针对 AI 代理循环中最关键的「生成阶段」所打造,目标是让代理每一个执行步骤都能即时响应。
拆解整台 Vera Rubin NVL72 与 Groq 3 LPX,这些机架配备了 NVIDIA BlueField-4 DPU、Vera CPU 机架、BlueField-4 STX 存储系统,以及 Spectrum-6 SPX 以太网络,形成以高吞吐量与低延迟推理为目标的完整 AI 工厂配置。
英伟达首席执行官黄仁勋(Jensen Huang)在声明中强调「推理是 AI 的成长引擎。」他指出,在全球 AI 运算需求加速的当下,Groq 3 LPX 将为 AI 系统带来吞吐量、效率与响应速度的全面跃升。
随着 AI 产业重心正从「训练」转向「推理」,计算需求与硬件要求也出现根本性转变。英伟达通过收购 Groq 的 LPU 技术,快速补强了 GPU 在低延迟推理场景下的先天限制,同时通过 Vera Rubin 平台的整合设计,形成训练与推理双轨并行的完整 AI 工厂解决方案。
从这个角度看,Groq 3 LPX 的量产不只是一款新产品的上市,而是英伟达在 AI 代理与推理时代到来之际,全面巩固竞争优势的关键一步。
免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。