狠狠干狠狠操-久青草视频-天堂网站-欧美日韩亚洲综合-黄色三级av-成人欧美在线-综合久久av-欧美人与禽zozzozzo-国产黄色高清视频-97影音-亚洲视频图片小说-国产 欧美 自拍-毛片的网站-天天干人人-欧美黄色免费在线观看-亚洲香蕉中文网-99热这里只有精品5-这里只有精品免费视频-看国产一级片-中国女人av

你的位置:首頁 > 互連技術 > 正文

英特爾銳炫Pro B70極速適配MiniMax H3

發布時間:2026-08-05 來源:轉載 責任編輯:lily

【導讀】英特爾為新一代開源多模態視頻模型MiniMax H3提供Day 0首發支持。依托英特爾銳炫? Pro B70的硬核實力及完整軟件生態,英特爾在第一時間實現了對該模型的深度適配,充分展現出其在AIGC前沿應用領域中高效響應、快速交付的卓越表現,也為廣大創意人士打開了一條低門檻、低成本、快速出片的視頻創作新路徑。


1785738044192009.png


借助AI開啟創作的形式,已從邊緣變成了主流,大模型也逐漸從輔助工具成長為核心擔當,商業潛力持續釋放。但成本依然是其規模化落地的道路上繞不開的一道坎。作為開源模型的破局者,MiniMax H3可實現精準可控的多模態內容編輯與生成,同時在成本上也極具優勢,大幅降低了企業和開發者、創作者參與內容創作的門檻。


開源模型的高效運行,離不開底層硬件能力的支撐。英特爾始終關注本土生態伙伴的技術動態,持續為本土大模型提供快速適配與深度支持。此次亦是如此,英特爾銳炫Pro B70第一時間完成對MiniMax H3的適配,實現了開箱即用的高效交付。這一快速響應的能力,既源于B70在硬件架構、軟件優化等方面的深厚積累,也是英特爾對本土生態長期投入的又一印證。


英特爾團隊實現了一種基于多卡 GPU的部署方案,以進一步釋放英特爾銳炫? Pro B70的計算潛力。該方案采用Encoder 8卡張量并行(8TP)、DiT 8 卡 USP(Ulysses Sequence Parallel,并結合Layer-wise Offloading),以及VAE部署于B70 GPU的整體架構,實現了視頻生成全流程的GPU加速。


其中,Encoder采用8卡張量并行完成文本編碼;作為推理過程中計算量最大的模塊,DiT采用8卡USP并結合Layer-wise Offloading技術,使模型參數按層動態加載到GPU,在突破單卡顯存限制、降低模型常駐顯存需求的同時,支持更大規模DiT模型的部署;VAE則部署于B70 GPU上完成最終的視頻解碼。該方案兼顧了模型容量與計算效率,為大規模視頻生成模型提供了更具擴展性的部署方式。


在此基礎上,團隊進一步結合張量并行(Tensor Parallel,TP)與USP的優勢,開發了2TP × 4USP的混合并行方案。相較于純8 卡 USP,該方案將USP并行度由8降至4,并引入2路張量并行對計算進行協同加速,在保持模型擴展能力的同時,減少USP帶來的通信開銷,實現計算負載與通信開銷之間更優的平衡,從而進一步提升整體推理性能。


此外,團隊還結合llm-scaler-omni項目的XPU Kernel優化,對矩陣乘法、注意力等關鍵算子進行了持續優化,進一步提升GPU的計算效率,持續降低端到端推理時延,取得了良好的優化效果。


英特爾銳炫Pro B70為用戶提供了具有出色成本效益的硬件底座。基于第二代Xe2架構, B70專為圖形渲染、通用并行計算與AI加速計算等專業工作負載打造。得益于32個Xe核心與32GB超大顯存,它適用于龐大的AI推理需求,不僅能順暢承載更大規模的 AI 模型與超長上下文,更能在多用戶高并發場景下保持高吞吐與快速響應,顯著提升模型的部署效益。


在此基礎上,英特爾完善的軟件生態進一步為模型的部署提供了支撐。配合包含Pytorch, vLLM, SGLang, SGLang Diffusion, ComfyUI, OneAPI在內的完整 AI 軟件棧,英特爾銳炫 Pro B70能夠靈活滿足多樣化部署需求。這在幫助企業降低部署門檻的同時,也為開源生態構建了更加穩健的軟硬件支持,推動視頻模型的生產力向端側延伸,激活多元場景的創想生機。


面對AI時代的廣闊機遇,英特爾加碼硬件創新與生態布局,以不斷升級的GPU架構、全棧軟件支持與開放生態為基礎,為客戶提供兼具出色成本效益與性能的硬件方案,推動AI向更多元的業務場景快速落地。



gg_20260512171736_266_20260622170931_179.png

特別推薦
技術文章更多>>
技術白皮書下載更多>>
熱門搜索

關閉

?

關閉