200 亿美元收购成果落地:英伟达 Groq 3 LPX 机架全面量产,今年上线

2026-08-25 09:14:24
来源:IT之家
分享
文章提及标的
英伟达--
人工智能--
云计算--
台积电--
查看股票机会下载客户端

IT之家8月25日消息,英伟达(NVDA)当地时间周一宣布,Groq3LPX机架已进入全面量产阶段,这标志着该公司史上最大规模收购所获得的技术正式实现商业化。

英伟达(NVDA)高级总监迪翁.哈里斯(Dion Harris)告诉记者,Groq机架将与Vera中央处理器和Rubin图形处理器一起部署在新型云服务商Nebius的平台,并将于今年晚些时候上线。

英伟达(NVDA)正在加速生产Groq芯片并向客户提供该产品,这凸显出低延迟推理的重要性日益提升。低延迟推理对于让人工智能(885728)智能体能够快速响应、避免用户遭遇长时间等待至关重要,尤其是在编程场景中。英伟达(NVDA)表示,云计算(885362)公司可以针对这类Token收取更高的费用。

哈里斯表示:“对于那些提供Token服务的人来说,这让他们能够为那些真正要求对延迟高度敏感的服务协议的用户和客户,提供高级服务等级。”

去年12月,英伟达(NVDA)以200亿美元(IT之家注:现汇率约合1,347.74亿元人民币)收购了芯片初创公司Groq的相关资产,这是该公司有史以来规模最大的一笔收购。

Groq的架构在芯片裸片本身集成了500MB高速SRAM,以减少与内存相关的瓶颈。Groq芯片由三星制造,而英伟达(NVDA)的GPU则由台积电(TSM)生产。

英伟达(NVDA)将256颗独立的Groq3芯片封装到其LPX机架中。英伟达(NVDA)表示,根据Artificial Analysis的一项基准测试,其Groq3LPX机架能够达到每秒3,400个Token的处理速度。

这是一个竞争激烈的领域。今年早些时候,AMD宣布,将把其机架级系统与Cerebras的芯片进行整合。Cerebras最近上市,并将低延迟推理作为重点。OpenAI新近宣布的“Ultrafast”模式目前承诺可达到每秒750个Token,并由Cerebras提供支持。

低延迟芯片并不会取代GPU,后者仍然是AI芯片领域的主力。GPU既可以执行训练,也可以执行推理,同时具备足够的灵活性,能够适应新技术和新模型。Groq这类低延迟芯片主要专注于模型服务过程中的一个环节,即所谓的“解码”(decode)阶段。

哈里斯表示:“这并不是要取代GPU,而是要针对工作负载的不同部分,使用价格合适、处理能力合适的处理器。”

目前,英伟达(NVDA)正在逐步增加Vera Rubin系统的出货量,该系统已于今年早些时候开始生产。在3月份发布Vera Rubin和Groq3LPX时,英伟达(NVDA)首席执行官黄仁勋预计,到2027年,当前一代Blackwell芯片与全新Vera Rubin系统的累计销售额将达到1万亿美元(现汇率约合6.74万亿元人民币)。

黄仁勋当时表示,他计划将数据中心中用于编程应用的空间的四分之一分配给Groq芯片。黄仁勋说:“我的数据中心其余部分将全部采用Vera Rubin。”

英伟达(NVDA)计划于当地时间周三公布财报。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME