AI 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s,超英伟达 RTX 5090D
最新 7 月 9 日消息,科技媒体 Wccftech 昨日(7 月 8 日)发布博文,报道称显卡厂商蓝戟(GUNNIR)测试英特尔 Arc Pro B70 GPU,在 DeepSeek R1 模型推理表现上超过英伟达的 RTX 5090D 和 RTX 4090D 显卡。
测试环境均为 4 张显卡配置,主要对比英特尔 Arc Pro B70 32GB、英伟达 RTX 5090D 32GB 与 RTX 4090D 24GB 三款显卡的 AI LLM 大语言模型推理性能表现。
测试模型为 DeepSeek R1-Distill Qwen 32B FP16,该模型固定输入 / 输出长度为 128 个 tokens,涵盖了从 1 到 512 的完整上下文并发范围,测试的核心指标为 token/s 吞吐量,用于衡量大语言模型推理时的输出效率。
在并发低于 32 时,RTX 5090D 位居前列,RTX 4090D 排名第二,Arc Pro B70 表现媲美 RTX 4090D;到并发 32 和 64 时,Arc Pro B70 已能追平并超过 RTX 4090D。
当并发达到 128 时,Arc Pro B70 的 token 吞吐量比 RTX 5090D 高 8.6%,比 RTX 4090D 高 34.2%。当并发达到 256 时,Arc Pro B70 比 RTX 5090D 高 7.5%,比 RTX 4090D 高 48.7%。在并发 512 时也观察到相近表现。最新附上相关图片如下:


英特尔 Arc Pro B70 GPU 在 Tokens 吞吐量方面表现最为出色,速度高达每秒 2320.76 个 Token。

《AI 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s,超英伟达 RTX 5090D》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
华为昇腾 950 超节点荣获 2026 世界人工智能大会最高荣誉 SAIL 奖
@华为中国 昨日(7 月 18 日)发布博文,宣布昇腾 950 超节点(Atlas 950 SuperPoD)荣获 2026 世界人工智能大会(WAIC)最高荣誉 SAIL 奖。... -
“反 AI”情绪愈演愈烈,多家头部 AI 公司加强高管安保
《华尔街日报》报道称,针对 AI 行业的敌意不断上升,开发先进 AI 模型的人员和企业正面临越来越多的威胁与袭击企图。多家头部 AI 公司已经加强安保,部分高管出行时甚至由武装保镖随行,另一些人则选择降低曝光度,减少公开活动。... -
OpenAI 回应 GPT-5.6 Sol AI 意外删除用户文件:已采取措施降低风险
OpenAI 核心产品负责人蒂博 · 索蒂奥(Tibo Sottiaux)于 7 月 16 日在 X 平台发布推文,回应 GPT-5.6 Sol 会擅自删除用户文件问题。... -
面向手机的 AI 游戏创作工具,《Roblox》移动版将更新“Build”功能
Roblox 为移动版客户端推出“Build”功能,用户通过简单提示词即可生成基础游戏,无需编程技能。该功能由多种 AI 模型驱动,支持生成玩法、环境、角色等。将于 7 月 28 日开启 Alpha 测试,首先面向新西兰用户开放。#Roblox #AI 游戏创作 #移动游戏开发#... -
歌曲生成平台 Suno 部分源码泄露,被发现全网爬取数百万歌曲训练 AI
科技媒体 404Media 昨日(7 月 16 日)发布博文,报道称基于黑客披露的 Suno 内部源代码,该 AI 歌曲生成平台从 YouTube Music、Deezer 和 Genius 等平台抓取数百万首歌曲来构建其核心模型。...












