DeepSeek R1 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s

2026-07-09 11:23:47
来源:IT之家
分享
文章提及标的

IT之家 7 月 9 日消息,科技媒体 Wccftech 昨日(7 月 8 日)发布博文,报道称显卡厂商蓝戟(GUNNIR)测试英特尔(INTC) Arc Pro B70 GPU,在 DeepSeek R1 模型推理表现上超过英伟达(NVDA)的 RTX 5090D 和 RTX 4090D 显卡。

测试环境均为 4 张显卡配置,主要对比英特尔(INTC) Arc Pro B70 32GB、英伟达(NVDA) RTX 5090D 32GB 与 RTX 4090D 24GB 三款显卡的 AI LLM 大语言模型推理性能表现。

测试模型为 DeepSeek R1-Distill Qwen 32B FP16,该模型固定输入 / 输出长度为 128 个 tokens,涵盖了从 1 到 512 的完整上下文并发范围,测试的核心指标为 token/s 吞吐量,用于衡量大语言模型推理时的输出效率。

在并发低于 32 时,RTX 5090D 位居前列,RTX 4090D 排名第二,Arc Pro B70 表现媲美 RTX 4090D;到并发 32 和 64 时,Arc Pro B70 已能追平并超过 RTX 4090D。

当并发达到 128 时,Arc Pro B70 的 token 吞吐量比 RTX 5090D 高 8.6%,比 RTX 4090D 高 34.2%。当并发达到 256 时,Arc Pro B70 比 RTX 5090D 高 7.5%,比 RTX 4090D 高 48.7%。在并发 512 时也观察到相近表现。IT之家附上相关图片如下:

英特尔(INTC) Arc Pro B70 GPU 在 Tokens 吞吐量方面表现最为出色,速度高达每秒 2320.76 个 Token。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME