AI 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s,超英伟达 RTX 5090D

2026-07-09 11:19 IT之家 - 故渊
感谢IT之家网友 华南吴彦祖 的线索投递!

IT之家 7 月 9 日消息,科技媒体 Wccftech 昨日(7 月 8 日)发布博文,报道称显卡厂商蓝戟(GUNNIR)测试英特尔 Arc Pro B70 GPU,在 DeepSeek R1 模型推理表现上超过英伟达的 RTX 5090D 和 RTX 4090D 显卡。

测试环境均为 4 张显卡配置,主要对比英特尔 Arc Pro B70 32GB、英伟达 RTX 5090D 32GB 与 RTX 4090D 24GB 三款显卡的 AI LLM 大语言模型推理性能表现。

测试模型为 DeepSeek R1-Distill Qwen 32B FP16,该模型固定输入 / 输出长度为 128 个 tokens,涵盖了从 1 到 512 的完整上下文并发范围,测试的核心指标为 token/s 吞吐量,用于衡量大语言模型推理时的输出效率。

在并发低于 32 时,RTX 5090D 位居前列,RTX 4090D 排名第二,Arc Pro B70 表现媲美 RTX 4090D;到并发 32 和 64 时,Arc Pro B70 已能追平并超过 RTX 4090D。

当并发达到 128 时,Arc Pro B70 的 token 吞吐量比 RTX 5090D 高 8.6%,比 RTX 4090D 高 34.2%。当并发达到 256 时,Arc Pro B70 比 RTX 5090D 高 7.5%,比 RTX 4090D 高 48.7%。在并发 512 时也观察到相近表现。IT之家附上相关图片如下:

英特尔 Arc Pro B70 GPU 在 Tokens 吞吐量方面表现最为出色,速度高达每秒 2320.76 个 Token。

文章价值:
人打分
有价值 还可以 无价值
置顶评论
    热门评论
      文章发布时间太久,仅显示热门评论
      全部评论
      一大波评论正在路上
        取消 发送
        分享成功

        长按关注IT之家公众号
        阅读更多精彩文章

        查看更多原创好文
        软媒旗下人气应用

        如点击保存海报无效,请长按图片进行保存分享