黄色一级大片在线免费看产-国产专区在线-第一章激情艳妇-天天拍天天操-精品乱码一区二区三四区视频-男生操女生在线观看-村上凉子av-欧美一区二区三区在线观看视频-69超碰-成人青青草-二区不卡-国产一区在线视频观看-综合久久国产-2022精品国偷自产免费观看-超碰888-最近高清中文在线字幕在线观看-麻豆精品网站-亚洲最大福利视频网-毛片国产精品-青青青手机在线视频

010-51626348
解決方案

光潤(rùn)通網(wǎng)絡(luò)傳輸解決方案

技術(shù)解決方案 行業(yè)解決方案 定制化解決方案

客戶成功案例

查看光潤(rùn)通網(wǎng)絡(luò)解決方案在各行業(yè)的成功應(yīng)用,了解客戶對(duì)光潤(rùn)通的評(píng)價(jià)。

了解更多信息>
服務(wù)與支持

服務(wù)宗旨

你的滿意是光潤(rùn)通畢生的追求,

您的煩惱也是困擾光潤(rùn)通的煩惱,

請(qǐng)將你的聲音傳達(dá)給我們,

讓我們?yōu)槟憬咝谋M力!

光纖網(wǎng)卡
關(guān)于光潤(rùn)通

我們的使命

加強(qiáng)產(chǎn)業(yè)核心技術(shù)和前沿技術(shù)研發(fā)并轉(zhuǎn)換成生產(chǎn)力,讓中國(guó)自己的民族企業(yè)支撐和指引整個(gè)高端光產(chǎn)業(yè)的健康發(fā)展。

光纖網(wǎng)卡
官方商城
選擇語(yǔ)言
  • 中文簡(jiǎn)體 English
  • 首頁(yè) > 新聞資訊 > 產(chǎn)品資訊
  • AI集群訓(xùn)練不只看GPU,國(guó)產(chǎn)25G網(wǎng)卡如何破解網(wǎng)絡(luò)墻

  • 發(fā)表時(shí)間:2026年08月20日
  • 眾所周知,大模型訓(xùn)練的核心瓶頸是算力。但當(dāng)GPU集群規(guī)模從幾十卡擴(kuò)展到上千卡,一個(gè)容易被忽視的問(wèn)題開(kāi)始浮出水面:GPU的大量時(shí)間,其實(shí)在等數(shù)據(jù)。

     

    分布式訓(xùn)練的基本邏輯是將模型切分到多張GPU上并行計(jì)算,每張GPU完成本地計(jì)算后,需要與其他GPU交換梯度數(shù)據(jù)。這個(gè)過(guò)程叫做All-Reduce,是分布式訓(xùn)練中最頻繁的操作。當(dāng)GPU算力越來(lái)越強(qiáng),單次前向和反向傳播的計(jì)算時(shí)間被大幅壓縮,但GPU之間的數(shù)據(jù)交換速度并沒(méi)有同步提升。結(jié)果就是:越強(qiáng)的 GPU,等待數(shù)據(jù)的時(shí)間占比越高。

     

    這就是AI基礎(chǔ)設(shè)施領(lǐng)域常說(shuō)的 "網(wǎng)絡(luò)墻" 問(wèn)題。算力的邊際提升已經(jīng)非常成熟,但網(wǎng)絡(luò)I/O正在成為制約集群訓(xùn)練效率的實(shí)際瓶頸。


    25G網(wǎng)卡


     

    繞過(guò)CPU:RDMA重新定義GPU通信

     

    傳統(tǒng)的網(wǎng)絡(luò)通信路徑是:GPU顯存 →CPU內(nèi)存 → 操作系統(tǒng)網(wǎng)絡(luò)協(xié)議棧 → 網(wǎng)卡 → 網(wǎng)絡(luò)。這條鏈路的問(wèn)題在于,每一次數(shù)據(jù)搬運(yùn)都要經(jīng)過(guò)CPU和操作系統(tǒng)內(nèi)核,而CPU的處理速度和內(nèi)核協(xié)議棧的開(kāi)銷,遠(yuǎn)遠(yuǎn)跟不上GPU的吞吐需求。

     

    RDMA(遠(yuǎn)程直接內(nèi)存訪問(wèn))技術(shù)的核心思路是繞過(guò)CPU和操作系統(tǒng),讓網(wǎng)卡直接讀寫(xiě)本機(jī)應(yīng)用內(nèi)存。對(duì)于AI訓(xùn)練場(chǎng)景,網(wǎng)卡可以直接讀寫(xiě)本機(jī)GPU顯存,消除本機(jī)側(cè)CPU內(nèi)存拷貝開(kāi)銷;數(shù)據(jù)通過(guò)網(wǎng)絡(luò)傳輸?shù)竭_(dá)對(duì)端服務(wù)器后,再由對(duì)端網(wǎng)卡直接寫(xiě)入對(duì)端本機(jī)GPU顯存。

     

    NVIDIA推出的GPU Direct RDMA進(jìn)一步將這個(gè)思路推到極致:網(wǎng)卡通過(guò)PCIe總線直接訪問(wèn)本機(jī)GPU顯存,無(wú)需經(jīng)過(guò)系統(tǒng)內(nèi)存。千卡級(jí)別的訓(xùn)練集群中,對(duì)比傳統(tǒng)數(shù)據(jù)轉(zhuǎn)發(fā)路徑,GPU Direct RDMA能夠顯著降低All-Reduce通信延遲,有效提升集群整體訓(xùn)練效率。

     

     國(guó)產(chǎn)網(wǎng)卡

     

    GPU Direct Storage則解決了另一個(gè)瓶頸:訓(xùn)練數(shù)據(jù)的加載。傳統(tǒng)方式下,存儲(chǔ)設(shè)備中的訓(xùn)練數(shù)據(jù)需要先加載到CPU內(nèi)存,再拷貝到GPU顯存。GPU Direct Storage允許NVMe存儲(chǔ)的數(shù)據(jù)繞過(guò)CPU內(nèi)存,直接寫(xiě)入本機(jī)GPU顯存,大幅縮短從數(shù)據(jù)讀取到模型訓(xùn)練的通路,該能力與網(wǎng)卡本身無(wú)關(guān)。

     

    以上兩項(xiàng)能力的落地前提保持一致:網(wǎng)卡必須支持高性能RDMA,并且具備足夠低的硬件延遲。

     

    25G:數(shù)據(jù)中心網(wǎng)絡(luò)的效率甜點(diǎn)

     

    為什么是25G而不是10G或100G?這個(gè)問(wèn)題在數(shù)據(jù)中心網(wǎng)絡(luò)架構(gòu)領(lǐng)域已經(jīng)有比較明確的共識(shí)。

     

    10G網(wǎng)卡在高密度虛擬化環(huán)境中已經(jīng)開(kāi)始吃力。單臺(tái)服務(wù)器運(yùn)行數(shù)十個(gè)虛擬機(jī)實(shí)例時(shí),10G帶寬往往被迅速打滿,成為性能瓶頸。而100G網(wǎng)卡雖然帶寬充裕,但對(duì)服務(wù)器 PCIe槽位和交換機(jī)端口密度的要求較高,在中等規(guī)模部署中性價(jià)比并不理想。

     

    25G恰好處于一個(gè)效率甜點(diǎn)。PCIe 4.0 x8的帶寬能力足以支撐雙口25G合計(jì) 50Gbps的流量,無(wú)需占用PCIe x16全寬槽位,為GPU和其他擴(kuò)展卡預(yù)留硬件安裝空間。對(duì)于采用Spine?Leaf架構(gòu)的數(shù)據(jù)中心,25G接入層配合100G骨干層的組合,可以在成本和性能之間取得最優(yōu)平衡,更加適配中小規(guī)模AI集群、虛擬化、分布式存儲(chǔ)等業(yè)務(wù)場(chǎng)景;千卡級(jí)超大規(guī)模AI訓(xùn)練集群,行業(yè)主流普遍采用100G及以上接入速率。

     

    更關(guān)鍵的是,25G SFP28插槽物理形態(tài)與10G SFP插槽相互兼容,硬件插槽可以復(fù)用。從 10G升級(jí)至25G,需要同步更換網(wǎng)卡、接入交換機(jī)以及25G光模塊,部分符合高速標(biāo)準(zhǔn)的布線可以繼續(xù)沿用,以此降低改造工作量。

     

    國(guó)產(chǎn)25G網(wǎng)卡的技術(shù)現(xiàn)實(shí)

     

    在信創(chuàng)推進(jìn)過(guò)程中,網(wǎng)卡環(huán)節(jié)長(zhǎng)期是一個(gè)隱性短板。整機(jī)廠商可以基于飛騰、鯤鵬、龍芯組裝服務(wù)器,操作系統(tǒng)有銀河麒麟和統(tǒng)信UOS,但在高速網(wǎng)卡層面,大量方案仍然依賴Intel、Mellanox等海外芯片。

     

    這種 "組裝式國(guó)產(chǎn)化" 在辦公場(chǎng)景下尚可運(yùn)轉(zhuǎn),但在AI訓(xùn)練、高性能計(jì)算等對(duì)網(wǎng)絡(luò)延遲和吞吐極為敏感的場(chǎng)景中,網(wǎng)卡芯片的自主性直接影響整體系統(tǒng)的可控程度。

     

    光潤(rùn)通基于自研G-810-2SZ以太網(wǎng)控制器推出的 FF-2502E-GZ 25G雙光口網(wǎng)卡,是目前國(guó)產(chǎn)方案中值得關(guān)注的選項(xiàng)。這款網(wǎng)卡采用PCIe 4.0 x8接口,雙 SFP28光口各支持25Gbps鏈路速率,硬件層面提供RDMA支持,兼容GPU Direct RDMA 能力,使GPU集群訓(xùn)練中的數(shù)據(jù)交換可以規(guī)避本機(jī)CPU內(nèi)存拷貝開(kāi)銷。

     

    在無(wú)損網(wǎng)絡(luò)方面,F(xiàn)F-2502E-GZ硬件支持PFC(基于優(yōu)先級(jí)的流量控制)、ECN(顯式擁塞標(biāo)記),配合主機(jī)側(cè)DCQCN 擁塞控制算法,共同構(gòu)成構(gòu)建RoCEv2 無(wú)損以太網(wǎng)絡(luò)的核心能力。PFC在接收端緩沖區(qū)即將溢出時(shí),僅暫停特定優(yōu)先級(jí)的流量而非全部流量;ECN在IP報(bào)文頭中標(biāo)記擁塞信號(hào)而非直接丟包;DCQCN運(yùn)行于主機(jī)側(cè),將二者能力結(jié)合,實(shí)現(xiàn)擁塞的提前感知和速率的動(dòng)態(tài)調(diào)整。三者協(xié)同,保障高吞吐場(chǎng)景下的低延遲傳輸。

     

    值得關(guān)注的是,這款網(wǎng)卡提供靈活的硬件卸載能力,可支撐上層部署PCC可編程擁塞控制協(xié)議與自定義RTT算法。傳統(tǒng)網(wǎng)卡硬件擁塞控制策略固化,難以針對(duì)業(yè)務(wù)做深度調(diào)優(yōu);依托網(wǎng)卡提供的硬件基礎(chǔ),PCC可根據(jù)實(shí)際業(yè)務(wù)反饋動(dòng)態(tài)調(diào)整發(fā)送速率,在AI訓(xùn)練、分布式存儲(chǔ)這類對(duì)延遲特征有特殊要求的業(yè)務(wù)中,給到業(yè)務(wù)側(cè)更大的調(diào)優(yōu)空間。

     

    在安全能力上,F(xiàn)F-2502E-GZ集成了IPSec、TLS和ACL的硬件卸載功能。IPSec 加解密和TLS密鑰運(yùn)算由網(wǎng)卡硬件完成,不占用CPU算力。對(duì)于需要加密傳輸?shù)挠?xùn)練數(shù)據(jù)和模型參數(shù),硬件級(jí)加密確保了安全性不以性能為代價(jià)。

     

    全棧國(guó)產(chǎn)化適配方面,該網(wǎng)卡已適配飛騰、鯤鵬、龍芯、申威、海光等國(guó)產(chǎn)CPU平臺(tái),以及銀河麒麟、統(tǒng)信UOS、中科方德等國(guó)產(chǎn)操作系統(tǒng),同時(shí)兼容CentOS、Ubuntu等主流Linux發(fā)行版。

     

    從網(wǎng)卡到生態(tài):國(guó)產(chǎn)網(wǎng)絡(luò)底座的完整拼圖

     

    一張網(wǎng)卡的能力再?gòu)?qiáng),也只是系統(tǒng)中的一個(gè)節(jié)點(diǎn)。網(wǎng)絡(luò)瓶頸的化解,需要網(wǎng)卡、交換機(jī)、無(wú)損網(wǎng)絡(luò)配置、驅(qū)動(dòng)協(xié)議棧整套系統(tǒng)協(xié)同,并非依靠單張網(wǎng)卡就可以徹底解決。光潤(rùn)通自研芯片網(wǎng)卡提供全速率(1G/2.5G/10G/25G/100G)的基礎(chǔ)連接能力,在信創(chuàng)從 "單品替代" 走向 "全棧閉環(huán)" 的當(dāng)下,網(wǎng)絡(luò)底座的國(guó)產(chǎn)化需要的不只是網(wǎng)卡本身,而是從芯片、驅(qū)動(dòng)、協(xié)議棧到上層應(yīng)用的完整協(xié)同。

     

    在AI算力基礎(chǔ)設(shè)施加速建設(shè)的背景下,國(guó)產(chǎn)高速網(wǎng)卡的意義不僅是替代進(jìn)口,更是為國(guó)產(chǎn)GPU集群提供一個(gè)真正自主可控的網(wǎng)絡(luò)底座。當(dāng)算力、存儲(chǔ)、網(wǎng)絡(luò)三個(gè)環(huán)節(jié)都實(shí)現(xiàn)了國(guó)產(chǎn)化閉環(huán),AI訓(xùn)練集群才能在性能、安全和供應(yīng)鏈三個(gè)維度上同時(shí)站住腳。

     

    網(wǎng)絡(luò)不應(yīng)該成為AI訓(xùn)練的瓶頸。國(guó)產(chǎn)25G高速網(wǎng)卡,正是補(bǔ)齊算力網(wǎng)絡(luò)底座拼圖的關(guān)鍵一環(huán)。


    上一篇 :
    從RDMA到GPUDirect:光潤(rùn)通100G網(wǎng)卡為AI與高性能計(jì)算網(wǎng)絡(luò)提供新選擇
    下一篇 :
    把安全帶在身邊:光潤(rùn)通千兆移動(dòng)安全BOX真實(shí)使用測(cè)評(píng)
    分享: