英伟达专用推理加速器Groq 3 LPX全面投产,为AI智能体提速
作者: CBINEWS
责任编辑: 邹大斌
来源: 电脑商情在线
时间: 2026-08-25 14:22
芯片巨头英伟达在Hot Chips 2026大会上宣布,其专用AI推理加速器Groq 3 LPX已进入全面量产阶段。这款新品是旗舰数据中心平台Vera Rubin的专用扩展组件,旨在提供超快的Token生成速度,以运行高响应性的智能体AI(Agentic AI)工作负载。云计算服务商Nebius集团已成为首个承诺采用该芯片的客户。
推理是指在生产环境中运行已训练完成的AI模型,其重心正日益转向能代表人类执行任务的自主AI智能体。这些智能体需要连续循环地进行推理规划、编写执行代码、检查系统文件和调用第三方工具,会在复杂链条中快速处理数千个Token,但有时会产生巨大的"解码延迟",造成恼人的卡顿。为避免这一情况,AI数据中心需要更专业化的计算架构,将大规模上下文处理与Token生成解耦,以提升智能体的推理与工作效率。
这正是Vera Rubin NVL72机架级平台的用武之地:数十颗Vera Rubin GPU负责大规模上下文摄取与处理,而Groq 3 LPX则承接解码工作负载。英伟达称,完整机架部署最多可容纳256颗LP30加速器,通过超高带宽芯片互连连接,使LPU与GPU协同计算智能体推理链的每一步,构成面向企业规模的统一推理引擎,从而消除吞吐量与响应时间之间的取舍。在Artificial Analysis的基准测试中,Groq 3 LPX运行开源Gemma 4 31B智能体模型(10万Token上下文窗口)时,输出速度达到创纪录的每秒3400个Token,比竞争对手平台快4倍。
这款芯片采用了从小型芯片公司Groq授权的技术。英伟达去年12月斥资200亿美元获得了其技术使用权,并聘请了创始人Jonathan Ross和总裁Sunny Madra。英伟达创始人兼CEO黄仁勋表示:"我们正借助LPX推进超快Token生成的性能前沿,这将改变智能的生产方式,带来AI吞吐量、效率和响应能力的又一次巨大飞跃。"
Nebius将把Groq 3 LPX用于其生产推理平台Nebius Token Factory。其CTO Danila Shtan表示:"生成阶段决定了AI系统的实际响应速度,而这正是Groq 3 LPX为之加速的目标。作为首家将其投入生产的AI云,我们要让智能体循环的每一步都感觉是瞬时的。"
英伟达在Hot Chips上还公布了其他进展:SpaceX已签约成为最新旗舰客户,将围绕Vera Rubin平台构建下一代AI架构;此外还展示了Spectrum-X Multiplane(可将服务器连接划分为并行路径、扩展至51.2万颗GPU集群的AI优化以太网架构)、卸载安全/网络/数据管理的基础设施软件平台Nvidia Scale-In,以及支持定制CPU和DPU接入第六代NVLink机架系统的NVLink Fusion。
