英伟达专用推理加速器Groq 3 LPX全面投产,为AI智能体提速

作者: CBINEWS

责任编辑: 邹大斌

来源: 电脑商情在线

时间: 2026-08-25 14:22

芯片巨头英伟达在Hot Chips 2026大会上宣布,其专用AI推理加速器Groq 3 LPX已进入全面量产阶段。这款新品是旗舰数据中心平台Vera Rubin的专用扩展组件,旨在提供超快的Token生成速度,以运行高响应性的智能体AI(Agentic AI)工作负载。云计算服务商Nebius集团已成为首个承诺采用该芯片的客户。

推理是指在生产环境中运行已训练完成的AI模型,其重心正日益转向能代表人类执行任务的自主AI智能体。这些智能体需要连续循环地进行推理规划、编写执行代码、检查系统文件和调用第三方工具,会在复杂链条中快速处理数千个Token,但有时会产生巨大的"解码延迟",造成恼人的卡顿。为避免这一情况,AI数据中心需要更专业化的计算架构,将大规模上下文处理与Token生成解耦,以提升智能体的推理与工作效率。

这正是Vera Rubin NVL72机架级平台的用武之地:数十颗Vera Rubin GPU负责大规模上下文摄取与处理,而Groq 3 LPX则承接解码工作负载。英伟达称,完整机架部署最多可容纳256颗LP30加速器,通过超高带宽芯片互连连接,使LPU与GPU协同计算智能体推理链的每一步,构成面向企业规模的统一推理引擎,从而消除吞吐量与响应时间之间的取舍。在Artificial Analysis的基准测试中,Groq 3 LPX运行开源Gemma 4 31B智能体模型(10万Token上下文窗口)时,输出速度达到创纪录的每秒3400个Token,比竞争对手平台快4倍。

这款芯片采用了从小型芯片公司Groq授权的技术。英伟达去年12月斥资200亿美元获得了其技术使用权,并聘请了创始人Jonathan Ross和总裁Sunny Madra。英伟达创始人兼CEO黄仁勋表示:"我们正借助LPX推进超快Token生成的性能前沿,这将改变智能的生产方式,带来AI吞吐量、效率和响应能力的又一次巨大飞跃。"

Nebius将把Groq 3 LPX用于其生产推理平台Nebius Token Factory。其CTO Danila Shtan表示:"生成阶段决定了AI系统的实际响应速度,而这正是Groq 3 LPX为之加速的目标。作为首家将其投入生产的AI云,我们要让智能体循环的每一步都感觉是瞬时的。"

英伟达在Hot Chips上还公布了其他进展:SpaceX已签约成为最新旗舰客户,将围绕Vera Rubin平台构建下一代AI架构;此外还展示了Spectrum-X Multiplane(可将服务器连接划分为并行路径、扩展至51.2万颗GPU集群的AI优化以太网架构)、卸载安全/网络/数据管理的基础设施软件平台Nvidia Scale-In,以及支持定制CPU和DPU接入第六代NVLink机架系统的NVLink Fusion。

ToB最前沿

ToB最前沿抖音号

CBI科技在线

地址:北京市朝阳区北三环东路三元桥曙光西里甲1号第三置业A座1508室 商务内容合作QQ:2291221 电话:13391790444或(010)62178877
版权所有:电脑商情信息服务集团 北京赢邦策略咨询有限责任公司
声明:本媒体部分图片、文章来源于网络,版权归原作者所有,我司致力于保护作者版权,如有侵权,请与我司联系删除
京ICP备:2022009079号-3
京公网安备:11010502051901号
ICP证:京B2-20230255