英特尔MLPerf v6.1成绩出炉:软件优化推动 AI 推理性能飞跃

胖明同学_4208

胖明同学_4208

2026-09-20

286人浏览

原创

在mlcommons最新发布的mlperf inference v6.1基准测试结果中,英特尔重点呈现了如何依托软件层面的深度优化,显著增强英特尔®至强®6处理器与英特尔锐炫™ pro b系列gpu在ai推理任务中的性能表现。这些亮眼成绩的背后,也反映出客户及生态合作伙伴参与度的持续深化——越来越多的系统选择在英特尔平台上完成验证,覆盖模型种类更广、工作负载更多元、部署场景更丰富。

在与MLPerf v6.0保持完全一致的芯片型号与插槽配置前提下,英特尔®至强®6980P处理器在Llama3.1 8B Server测试中实现了高达2.4倍的吞吐量增长,在Offline模式下亦达成56%¹的性能跃升。尤为关键的是,所有性能增益均源自纯软件优化,无需更换现有硬件设备。这有力印证了:通过持续投入软件创新,客户可在不改变已部署基础设施的前提下,获得可观的性能升级。这一趋势同样体现在英特尔生态伙伴的积极实践中。

英特尔数据中心事业部数据中心软件副总裁Bill Pearson指出:“MLPerf Inference v6.1的成绩充分表明,稳健的软件优化能力,能够帮助客户从既有硬件中进一步挖掘性能潜力。我们正加速构建覆盖至强与锐炫Pro平台的全栈式AI软件体系,并不断扩大对主流模型、多样化工作负载以及各类系统形态的支持范围。”

随着AI推理迈入规模化落地阶段,用户对计算平台的需求已不再局限于单一性能指标,而是要求其具备支撑更大规模、更复杂模型的能力,同时支持长期演进与持续优化,从而提供更高的灵活性与投资回报率。英特尔在MLPerf Inference v6.1中所展现的成果,正是对这一诉求的有力回应:软件优化正成为释放存量算力价值的关键路径,助力客户实现CPU与GPU资源的横向协同扩展。

客户与合作伙伴在英特尔平台上的参与广度与深度同步提升——提交结果数量由v6.0的29项增至v6.1的39项,且第三方独立验证占比明显提高²。其中,甲骨文(Oracle)首次基于英特尔平台提交测试结果;红帽(Red Hat)首次以至强CPU完成推理性能提交;广达云科技(Quanta Cloud Technology)与超微(Supermicro)则率先提供了搭载英特尔锐炫 Pro B70 GPU的合作伙伴实测数据。

英特尔至强6测试成果:在MLPerf v6.1中,至强处理器的测试覆盖进一步拓展。参与测试的至强6 SKU数量由v6.0的2款增加至5款,CPU推理类测试条目也从24项提升至35项。与此同时,至强平台仍是MLPerf Inference测试中唯一以独立服务器级CPU身份完成全部提交的平台。

Multi-Brain Protocol
Multi-Brain Protocol

一款AI工具,主要用于在主代理响应前,并行运行Kimi K2.5和GPT 5.3 Codex,注入双方观点以增强认知多样性,适合需要提升相关任务效率的用户。

下载

英特尔锐炫 Pro B70测试成果:锐炫系列的表现再次凸显软件优化对AI模型性能提升的重要作用。一套配备四块英特尔锐炫 Pro B70 GPU的单节点系统,拥有总计128GB显存容量,成功完成了包括Llama3.1 8B、Llama2 70B、gpt-oss-120B、Whisper,以及端到端检索增强生成(E2E-RAG)在内的多类模型与典型应用场景的测试提交。在与MLPerf Inference v6.0完全相同的四卡配置下,gpt-oss-120B在Server模式下性能提升36%,Offline模式下提升27%,充分体现了英特尔软件栈持续迭代所带来的切实收益³。

全新E2E-RAG基准测试:英特尔深度参与了MLPerf Inference v6.1新增的端到端检索增强生成(E2E-RAG)基准测试的设计与开发,并提交了完整测试结果。作为本轮测试中最具挑战性的工作负载之一,该测试系统采用一台英特尔至强6787P处理器搭配四块英特尔锐炫 Pro B70 GPU构成,将整体AI流水线任务智能拆分并分配至不同硬件单元:至强处理器承担嵌入(Embedding)、重排序(Re-ranking)、向量检索(Vector Search)及轻量语言模型推理;而锐炫 Pro B70 GPU则专注于大语言模型的文本生成任务。该结果清晰表明,经过深度调优的CPU与GPU可在完整的AI推理链路中实现高效协作。

英特尔的优化实践远不止于基准测试本身。至强处理器相关的多项优化成果,正陆续集成至PyTorch、TensorFlow等主流AI框架中,使客户无需调整现有IT架构,即可无缝受益于软件层面的持续改进。针对锐炫 Pro B70的优化工作,也将为未来英特尔GPU在底层内核、上层框架适配及推理服务栈等方面的演进奠定坚实基础。

英特尔MLPerf v6.1成绩出炉:软件优化推动 AI 推理性能飞跃

相关文章

数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

相关标签:

英特尔

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
Aionclaw智能助手介绍
Aionclaw智能助手介绍

本专题汇总了AionClaw(AI龙虾助手)的功能介绍与在线使用入口。AionClaw是杭州趣猿人工智能有限公司推出的桌面级AI智能体,能直接在电脑上读写文件、运行脚本、操作浏览器,自动交付Word、PPT、Excel等成品。

2026.09.20

20

13

AionClaw AI智能体与电脑自动化任务执行功能使用教程
AionClaw AI智能体与电脑自动化任务执行功能使用教程

AionClaw专题整理AI智能体与电脑自动化相关功能使用教程,涵盖安装部署、AI任务执行、Skills技能、文件处理、浏览器控制、电脑操作、持久记忆、聊天工具连接以及办公、编程和内容创作等功能,帮助用户快速掌握AionClaw的实际使用方法。

2026.09.20

0

15

AI视频生成软件推荐
AI视频生成软件推荐

本专题汇总了当前主流的AI视频生成软件推荐与排行榜单,涵盖seko、AniShort、剧云、Lovart、LiblibAI及立刻mv等热门工具。同时整理了各软件在文生视频、图生视频、时长限制、画质表现及免费额度等方面的差异对比,助您快速选对适合创作需求的AI视频生成工具。

2026.09.16

180

9

ai生成视频的工具免费版合集
ai生成视频的工具免费版合集

本专题汇总了当前免费AI生成视频工具的排行榜与推荐清单,涵盖seko、讯飞智作、AniShort及剧云、Lovart等多模型集成平台。同时整理了各工具的免费额度、输出时长、水印政策及适用场景差异,助您快速选择合适工具开启AI视频创作。

2026.09.16

100

10

Pandas时间序列分析与可视化报表
Pandas时间序列分析与可视化报表

本专题整理Pandas日期转换、时间索引、重采样、滚动窗口、时区处理、plot绘图、Styler表格样式和报表输出方法。

2026.09.16

80

23

Pandas数据筛选索引与清洗处理
Pandas数据筛选索引与清洗处理

本专题整理Pandas中的loc、iloc、条件筛选、query查询、缺失值处理、重复值删除、类型转换和字符串列清洗方法。

2026.09.16

60

25

Pandas数据读取导入与文件导出处理
Pandas数据读取导入与文件导出处理

本专题整理Pandas读取CSV、Excel、JSON、SQL、Parquet等文件的方法,以及to_csv、to_excel、to_sql和to_parquet等常用数据导出流程。

2026.09.16

40

27

GDB怎么设置断点
GDB怎么设置断点

本专题介绍GDB按照函数名、源代码行号和文件位置设置断点的方法,详细说明run、continue、next、step等命令的配合使用,帮助定位程序崩溃、逻辑异常及代码未按预期执行的问题。

2026.09.11

400

28

GDB怎么查看变量值
GDB怎么查看变量值

本专题介绍GDB调试过程中查看变量值的具体方法,涵盖局部变量、函数参数、数组、结构体和指针内容查询,同时整理变量持续显示、格式化输出及无法读取变量时的排查思路。

2026.09.11

120

22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
phpStudy极速入门视频教程
phpStudy极速入门视频教程

共6课时 | 54.6万人学习

独孤九贱(4)_PHP视频教程
独孤九贱(4)_PHP视频教程

共89课时 | 133万人学习