banner
首頁 >

技術文章

廣東宏展科技:AI算力整機柜時代,步入式環境試驗箱如何破解“尺寸·發熱·液冷”三道難題

一、算力產業進入“整機柜”時代

去年9月18日,華為全聯接大會在上海發布昇騰960超節點,卡規模拓展至15488張昇騰卡。與此同時,中科曙光十萬卡液冷集群“曙光8000(登峰)”采用相變浸沒液冷技術,PUE值降至1.04以下,單機柜功率密度突破900kW。國家數據局數據顯示,截至2026年7月底,全國智算總規模達245萬PFLOPS(FP16),已有145萬PFLOPS智能算力納入監測調度平臺。

算力基礎設施的規模化躍進,正在重塑AI服務器的產品形態:從單機走向整機柜,從風冷走向液冷。一臺搭載8塊GPU的主流AI服務器,峰值功耗輕松突破10kW,42U標準機柜加上液冷管路和電源分配單元,整體尺寸遠超常規試驗箱的容納范圍。整機柜級可靠性驗證,已從“可選項”變為“必選項” 。GB/T 2423.2-2008明確規定,服務器高溫測試溫度需達到55℃至85℃,測試時長不低于16小時。而YD/T 6361-2025《云數據中心服務器機柜測試方法》進一步將整機柜產品可靠性測試納入行業規范。

二、整機柜測試的三道難題

難題一:尺寸——裝不進去,一切都是空談。 標準42U服務器機柜尺寸為高2000mm×寬600mm×深1200mm,帶設備總重量超過800kg。常規環境試驗箱的內容積通常在數百升量級,根本容不下整柜系統。若采用拆解測試,將服務器從機柜中取出后分別測試,則無法模擬整柜裝配后的真實熱環境與系統配合情況,測試結果不能反映整機的真實可靠性。

難題二:發熱——設備自身就是“熱源”。 與被動受熱的傳統元器件不同,AI服務器在測試過程中處于滿負載運行狀態,機柜自身發熱功率不低于30kW,瞬時熱流密度可達傳統服務器的3至5倍。當硬件工作溫度觸及85℃至90℃的臨界**閾值時,GPU會自動啟動熱節流程序,運行效率下滑高達25%。這意味著試驗箱不僅要按程序改變環境溫度,還必須實時抵消設備自身持續產出的數十千瓦熱量。

難題三:液冷——帶液運行,密封是關鍵。 液冷AI服務器在測試過程中需要保持冷卻液正常循環,試驗箱必須預留液冷管路穿墻接口,接口需密封可靠,不能出現冷橋結露或漏風影響溫場。這對試驗箱的密封設計、管路布局和防凝露控制提出了遠超常規環境試驗設備的要求。

三、傳統試驗設備的力不從心

傳統步入式高低溫試驗箱在設計之初主要面向低發熱或無發熱試件,制冷能力普遍低于10kW,面對30kW的持續發熱根本無法將箱內溫度降至設定值。更為關鍵的是,部分廠商標稱的溫變速率是空載狀態下的最大值,一旦放入滿負載運行的高功耗設備,實際速率可能驟降至標稱值的幾分之一,測試數據嚴重失真。

此外,傳統試驗箱不具備液冷管路穿墻接口,無法完成帶液運行測試。如果將整柜送至第三方檢測機構,不僅費用高昂、排隊長達一個多月,還存在新產品技術方案泄露的風險。

四、宏展Walk-in步入式方案:關鍵參數與技術能力

廣東宏展科技(Lab Companion)位于廣東省東莞市,在東莞、昆山、重慶設有三大研發制造工廠,專注環境與可靠性試驗設備研發制造二十余年。針對AI算力整機柜測試需求推出的高發熱大負載Walk-in步入式快溫變試驗箱,圍繞上述三道難題給出了系統性回答。

應對尺寸難題: CW2000型設備內部凈尺寸為寬1500mm×深2000mm×高2200mm,內容積2000L,可輕松容納標準42U服務器機柜。箱底采用10號槽鋼焊接框架,鋪設5mm厚花紋鋼板,額定承重1500kg。設備采用雙開門設計,開門寬度1400mm、高度2100mm,機柜可直接水平推入,無需拆解或傾斜。容積覆蓋1000L至10000L,可依據客戶需求進行更大尺寸的非標拓展。

應對發熱難題: 設備采用二元復疊制冷系統,額定制冷量60kW,標準機型可同時帶載1000kg鋁錠與50kW被測件自發熱。在滿載條件下,+100℃→0℃平均降溫速率為5K/min,0℃→+100℃平均升溫速率為5K/min,所有速率均為滿載實測值而非空載標稱值。控溫精度方面,溫度波動性≤1.0K,溫度均勻性≤2.0K,溫度偏差±2.0K。技術路徑上采用間接制冷系統配合上送風、下回風閉式循環風道,箱體兩側或后部布置多個可調式出風口,配合多點PID同步調節與分區補償控制策略,有效避免大空間高負載工況下的氣流死角與局部過熱。

應對液冷難題: 設備可定制液冷管路穿墻密封接口,支持將外部CDU(冷量分配單元)的供回液管路引入箱內,在溫度循環測試過程中保持液冷系統正常循環。箱內設置的積液檢測與報警裝置可及時發現泄漏風險,確保帶液測試的穩定性與溫場穩定性。

五、從單柜到集群:測試體系的延伸

整機柜測試能力的建立,并非單一設備參數的簡單疊加,而是從芯片級到整柜級測試鏈條的系統性貫通。

國內某頭部AI服務器廠商在2026年推出新一代液冷AI服務器時,面臨整柜測試的現實難題:單柜配置8顆大算力GPU,采用冷板式液冷散熱,滿負載運行時機柜總功耗超過30kW。宏展科技為該客戶提供了定制化方案,配套至少20路溫度采集通道,可同時監控GPU、冷板、進出水口等關鍵位置溫度,所有數據自動記錄、不可篡改。該方案配合客戶完成了總計300小時的連續可靠性測試,覆蓋高溫高濕、低溫存儲、溫度循環三個階段,一次性通過所有測試項目。

從測試體系的角度看,Walk-in步入式快溫變試驗箱的價值不僅在于承載單個42U機柜的驗證需求。隨著算力集群從數十柜向數百柜、數千柜擴展,整機柜可靠性驗證的批量化和標準化將成為新的工程課題。宏展科技正在將整柜測試方案向集群級測試場景延伸,為算力基礎設施企業提供從單柜驗證到批量測試的體系化能力。

六、交付前的最后一道驗證

當算力產業從“萬卡時代”邁入“十萬卡時代”,每一臺出廠的AI服務器整機柜都承載著數據中心穩定運行的期望。整機柜級可靠性驗證,是產品交付客戶前的最后一道防線,也是產品上市前繞不開的關鍵一關。

廣東宏展科技Walk-in步入式快溫變試驗箱,以50kW熱負載處理能力、1000kg機械負載承載、滿載5K/min溫變速率、液冷管路穿墻接口和42U整柜容納能力,為AI服務器整機柜測試提供了從尺寸到發熱、從液冷到數據的完整工程方案。在算力基礎設施加速建設的當下,可靠的測試設備是產品質量的基石,也是產業健康發展的保障。