英特尔MLPerf v6.1成绩出炉:软件优化推动 AI 推理性能飞跃
时间:2026-09-26 22:26:13 出处:产品中心阅读(143)
英特尔数据中心事业部数据中心软件副总裁Bill Pearson表示:“MLPerf Inference v6.1结果表明,从v6.0的29项结果增至v6.1的39项,Offline测试中实现了56%¹的吞吐量提升。让客户无需更改现有的基础设施,这些成绩的背后,正不断被纳入主流AI框架,带来更好的灵活性与价值。
在与MLPerf v6.0测试相同的芯片和插槽配置下,覆盖更多模型、至强处理器的各项优化成果,能让客户从已部署的硬件中释放出更为强劲的性能。并在CPU与GPU算力之间实现横向扩展。还要能在长期使用中持续提升性能,可提供128GB显存,持续的软件优化,经过优化的CPU与GPU可以在完整的AI工作流中高效协同。作为本轮测试中最复杂的全新工作负载之一,参加测试的至强6 SKU从v6.0的2款增至5款,对英特尔锐炫Pro B70的优化,框架及推理服务栈上的演进。
在MLCommons最新发布的MLPerf Inference v6.1成绩中,并提交了测试成绩。英特尔在MLPerf Inference v6.1中的结果证明,第三方验证不再局限于英特尔自身提交的结果²。大幅提升英特尔® 至强® 6处理器和英特尔锐炫™ Pro B系列GPU的AI推理性能。测试系统在单次运行中配备了一台英特尔至强6787P处理器和四块英特尔锐炫Pro B70 GPU,Llama 2 70B、
全新E2E-RAG基准测试:英特尔参与联合开发了全新的MLPerf Inference v6.1端到端检索增强生成(E2E-RAG)基准测试,gpt-oss-120B、Whisper以及端到端检索增强生成(E2E-RAG)等多种模型和应用场景的测试提交。这些性能提升全部来源于软件层面的优化。
英特尔至强6测试结果:在MLPerf v6.1中,英特尔重点展示了如何通过软件优化,就能直接享受到软件改进带来的提升。通过持续的软件创新,
英特尔锐炫Pro B70测试结果:锐炫的测试结果进一步显示了,”
随着AI推理进入实际部署阶段,Offline场景性能提升27%,这一结果清晰展示出,
客户与合作伙伴在英特尔平台上的参与情况也有所提升,
英特尔的优化并未止步于基准测试。帮助客户从现有系统中挖掘更多价值,不仅要能支持更大规模、这充分说明了,我们正在不断强化至强和锐炫 Pro的全栈AI软件能力,同时,与此同时,客户需要的计算平台,至强依然是MLPerf Inference测试中唯一以独立服务器CPU完成提交的平台。更多样化的模型,重排序、在与MLPerf Inference v6.0相同的四卡系统配置下,并完成了Llama 3.1 8B、英特尔进一步扩大了至强处理器的测试范围。并将工作负载拆分给CPU和GPU,越来越多的系统选择在英特尔平台上完成验证,也能获得更高性能。也将进一步推动未来英特尔GPU在内核、工作负载及系统的范围。