鉅亨網編譯陳韋廷
近日,AI晶片巨擘輝達在2026年AI Infra Summit上發布DSX MaxLPS全廠級功耗優化系統,根據該公司超大規模與高效能運算業務副總裁Ian Buck介紹。DSX MaxLPS可在不新增電力基礎設施的前提下,把每兆瓦可驗證智能體token產出最高提升至1.4倍。
Buck指出,AI基礎設施評估已從峰值算力轉向「每兆瓦token」,AI工廠要做晶片到電網協同設計。
MaxLPS核心是動態重分配GPU與機架功率,將總電力預算攤到更多節點、以中等負載取代少數節點滿載,總功耗不變,但吞吐更高。
AI雲端服務商Lambda在19個節點HGX B200集群實測,全節點以85%功率運行替代原16節點滿載,token吞吐由約每秒400萬增至500萬、提升24%,每瓦性能同步增23%。
Lambda雲端業務總裁Dave Ward表示,在電力與散熱受限環境下,這種「不加電、提密度」的調度比堆硬體更關鍵。
MaxLPS隸屬DSX平台,與Dynamo推理軟體、NeMo、NVLink、Spectrum-X、ConnectX SuperNIC、BlueField DPU構成全端。
輝達表示,在Vera Rubin NVL72架構中,MaxLPS可使單機架GPU容量最高增加40%、Token吞吐最高增加35%,且無需新拉動電力線。
輝達與Emerald AI在Silicon Valley Power的彈性負載專案也示範DSX Flex,電網高壓時AI工廠功率由4MW自動降至3MW,關鍵負載不中斷、低優先任務掛起,電網緩解後自動恢復。
對超大規模客戶而言,MaxLPS把「買更多電」轉為「把既有電重新調度」,有望緩解資料中心接電、散熱與算力交付矛盾,但是否普遍適用於異構集群、不同推理模型,仍需要更多第三方基準驗證。
上一篇
下一篇
