日韩av电影在线观看-在线视频91-麻豆国产91在线播放-欧美人性生活-六月丁香激情-天堂资源中文在线-国产人人看-黄色资源网站-色综合视频在线-成人av片在线观看-不卡的毛片-精品久久久视频-日韩av三区-欧美人妻精品一区二区三区-黑人性高潮

星空人工智能技術網(wǎng)

中科曙光宣布實現(xiàn)國產(chǎn)高端原生RDMA技術重大突破

3月12日,中科曙光宣布實現(xiàn)國產(chǎn)高端原生RDMA技術重大突破,正式發(fā)布首款全棧自研400G無損高速網(wǎng)絡——scaleFabric。該產(chǎn)品基于原生RDMA架構,從底層的112G SerDes IP、硬件設備到上層的管理軟件實現(xiàn)100%自主研發(fā),填補了國內(nèi)數(shù)據(jù)中心高速網(wǎng)絡領域的空白,以比肩國際頂尖同類產(chǎn)品的性能表現(xiàn),為超大規(guī)模智算集群鋪就了一條高帶寬、低時延、真無損、超可靠的“算力大動脈”。

高端智算互聯(lián)待破局

隨著AI大模型訓練與高通量推理計算需求持續(xù)擴大,萬卡級乃至更大規(guī)模的算力集群正成為主流形態(tài)。研究表明,在大規(guī)模分布式訓練中,網(wǎng)絡通信耗時占比已達到30-50%,網(wǎng)絡性能直接影響算力系統(tǒng)的整體效率。

在大規(guī)模智算集群領域,RDMA(遠程直接內(nèi)存訪問)網(wǎng)絡已成為算力中心的基本需求,憑借零丟包、高帶寬、低延遲等特征,可極大提升通信效率。其中,InfiniBand憑借低時延與原生無損傳輸能力,在全球頂級超算與AI集群中被廣泛采用。根據(jù)TOP500榜單,目前全球約60%的高性能計算系統(tǒng)采用InfiniBand網(wǎng)絡架構。

長期以來,從高速SerDes IP、核心芯片到IB網(wǎng)卡、IB交換機等設備,InfiniBand相關產(chǎn)業(yè)鏈基本被海外廠商壟斷。隨著AI算力需求快速增長及數(shù)據(jù)中心網(wǎng)絡持續(xù)演進,自主高性能RDMA網(wǎng)絡正成為產(chǎn)業(yè)關注焦點。中國工程院院士鄔賀銓表示,高速網(wǎng)絡作為算力基礎設施的核心關鍵技術,其自主可控性直接關系到國家算力基礎設施的安全與發(fā)展質(zhì)量。在大模型訓練和智算集群規(guī)模化部署背景下,網(wǎng)絡需要同時具備超低延遲、超高帶寬與無損傳輸能力,而RDMA高速網(wǎng)絡正是智算集群的“算力大動脈”。

國產(chǎn)原生RDMA問世

scaleFabric是國內(nèi)首款原生無損RDMA高速網(wǎng)絡,面向超大規(guī)模智算集群設計,從核心關鍵IP、交換芯片、網(wǎng)卡到交換機、驅(qū)動與管理軟件均實現(xiàn)自主研發(fā),構建起從硬件到軟件的完整技術體系。

此次發(fā)布的scaleFabric400系列網(wǎng)絡產(chǎn)品技術規(guī)格全面對標英偉達NDR,部分指標實現(xiàn)趕超。性能方面,scaleFabric400網(wǎng)卡基于PCIe5.0接口,端口帶寬達400Gbps,端到端通信時延低至0.9微秒;scaleFabric400交換機單端口帶寬達800Gbps,整機交換容量可達雙向64Tbps,交換時延約260納秒,支持800G×40或400G×80端口擴展。這一性能組合,可充分滿足萬卡級AI訓練集群對高帶寬、低時延網(wǎng)絡的極致需求。

穩(wěn)定性與擴展能力上,產(chǎn)品采用基于信用的無損流控機制,從根源規(guī)避擁塞丟包風險,鏈路故障恢復時間小于1毫秒,已支撐近萬卡集群持續(xù)穩(wěn)定運行驗證超10個月。與英偉達NDR相比,交換機端口密度提升25%,網(wǎng)卡最大QP數(shù)支持提升100%,單子網(wǎng)互連規(guī)模是傳統(tǒng)IB的2.33倍,可輕松支持最大11.4萬卡集群部署,同時網(wǎng)絡總成本可降低30%。

在大規(guī)模AI訓練系統(tǒng)中,網(wǎng)絡互聯(lián)能力已成為影響算力利用率的關鍵變量。scaleFabric的發(fā)布,標志著國產(chǎn)智算網(wǎng)絡在高端RDMA領域?qū)崿F(xiàn)重大突破。

萬卡集群率先驗證

在實際應用層面,scaleFabric目前已部署于國家超算互聯(lián)網(wǎng)鄭州核心節(jié)點,支撐三套萬卡級scaleX智算集群上線運行,總規(guī)模達3萬卡。中科曙光高級副總裁李斌表示,隨著產(chǎn)品在超大規(guī)模智算集群中的落地應用,國產(chǎn)原生RDMA技術路線正逐步走向成熟,圍繞其形成的高性能網(wǎng)絡產(chǎn)業(yè)生態(tài)也正在加速形成。

999.jpg

 

運行數(shù)據(jù)顯示,該網(wǎng)絡系統(tǒng)在大規(guī)模集群環(huán)境中保持穩(wěn)定運行,可支持跨POD組網(wǎng)及大規(guī)模并行訓練任務,為國產(chǎn)原生無損RDMA網(wǎng)絡在高端智算基礎設施中的應用提供了實踐驗證。

依托在高性能計算、存儲與網(wǎng)絡領域的長期技術積累,中科曙光已逐步形成“算—存—網(wǎng)”協(xié)同發(fā)展的完整算力底座能力,為大規(guī)模AI基礎設施提供系統(tǒng)級支撐。隨著政府工作報告提出持續(xù)推進“星空人工智能+”,算力基礎設施正進入新一輪升級周期。國產(chǎn)原生RDMA網(wǎng)絡的落地,意味著我國在智算互聯(lián)這一關鍵環(huán)節(jié)開始形成自主技術路徑,補齊了我國智算基礎設施中的關鍵一環(huán)。

星空人工智能技術網(wǎng) 倡導尊重與保護知識產(chǎn)權。如發(fā)現(xiàn)本站文章存在版權等問題,煩請30天內(nèi)提供版權疑問、身份證明、版權證明、聯(lián)系方式等發(fā)郵件至1851688011@qq.com我們將及時溝通與處理。!:首頁 > 新聞 » 中科曙光宣布實現(xiàn)國產(chǎn)高端原生RDMA技術重大突破

感覺不錯,很贊哦! ()
分享到:

相關推薦

留言與評論(共有 0 條評論)
   
驗證碼: