AI算力需求正從「搶GPU」進一步轉向爭取能夠穩定商用的運算資源。鴻海(2317)旗下亞灣超算今(31)日宣布,首座採用NVIDIA HGX B300系統建置的5MW AI集群正式上線,不僅已簽下首批客戶長期租賃合約,更以超過9成使用率投入商業營運。亞灣超算表示,這也是目前全台規模最大的同類型AI集群,反映大型模型訓練與推論需求,正由測試階段加速進入正式生產環境。
這座集群同步通過NVIDIA Exemplar Cloud針對HGX B300訓練工作負載進行的驗證,使亞灣超算成為全球前十家、亞洲第二家完成這項生產級AI訓練驗證的NVIDIA Cloud Partner(NCP)。
對鴻海而言,5MW集群上線也不只是新增一批AI設備。隨著亞灣開始承接GPU雲端、模型訓練、推論及AI Agent部署,鴻海在AI市場的角色正由伺服器與基礎設施製造,進一步延伸至算力及平台營運。
不只搶GPU 企業更需要能正式商用的AI算力。隨著生成式AI、代理式AI(Agentic AI)及多模態模型快速發展,企業所需要的已不只是取得GPU,而是整套AI基礎設施能否長時間支援模型訓練、微調、推論及正式對外服務。
亞灣超算指出,企業對AI基礎設施的需求,已從「擁有GPU」轉向「能否穩定支撐生產環境」。相較於短期測試或概念驗證,大型AI模型正式上線後,還必須面對供電、散熱、高速網路、集群穩定性及持續維運等問題。
因此,此次上線的5MW集群採用水冷、2N高可用架構及NVIDIA Quantum-X800 InfiniBand網路,藉此支援大型模型訓練與推論所需的高速資料傳輸,以及大量GPU長時間協同運算。
亞灣超算在集群正式上線前即取得首批客戶長期租約,並以逾9成使用率投入商業營運,顯示市場需求已不只停留在取得AI晶片,而是進一步轉向可直接導入正式生產環境的完整算力服務。
全球前十家通過驗證 以四款大型模型測試。亞灣超算此次完成的NVIDIA Exemplar Cloud驗證,主要用來確認AI基礎設施能否提供可預測、符合正式生產規模的運算效能。
驗證過程透過NVIDIA Performance Benchmarking工具,導入DeepSeek-V3、Llama 3.1、Qwen3及Grok-1等大型AI工作負載,檢驗平台的運算效能、網路效率、集群穩定性,以及長時間運行的一致性。
對企業客戶而言,這項驗證可作為判斷AI平台是否具備正式商用條件的參考,降低自行建置大型GPU集群時所面臨的系統整合及營運風險。
亞灣超算此次成為全球前十家、亞洲第二家通過NVIDIA HGX B300生產級AI訓練驗證的NVIDIA Cloud Partner。所謂「全球前十」,指的是躋身全球前十家完成這項驗證的業者,而非全球AI算力或效能前十名。
從模型訓練到AI Agent部署 亞灣不只出租GPU。除了提供GPU運算資源,亞灣超算也試圖把服務範圍由傳統算力租賃,進一步擴大至企業導入AI所需的平台管理與應用部署。
亞灣超算將這套服務架構稱為「Tokenized AI Factory」,整合AI基礎設施、GPU Cloud、AI全域可視化營運平台及Token Factory平台,涵蓋模型訓練、微調、推論到AI Agent部署。
這項布局意味亞灣超算不只按照運算資源提供GPU租賃,也希望進一步承接模型及AI應用正式上線所需的管理服務。隨著AI算力供應持續擴大,單純GPU租賃可能面臨價格競爭,能否提供模型部署、系統維運及應用平台,將成為提高客戶黏著度與服務附加價值的重要關鍵。
鴻海AI版圖向服務端延伸 下一步布局Vera Rubin。亞灣超算是鴻海旗下專責發展超算中心及雲端運算營運平台的業者。過去鴻海在AI市場主要扮演伺服器、機櫃、散熱、關鍵零組件與資料中心基礎設施供應商,如今透過亞灣超算投入超算中心和GPU雲端營運,也讓集團角色由硬體製造延伸至算力與平台服務。
換言之,鴻海不只替客戶製造AI伺服器,也開始直接經營運算資源,並嘗試承接模型訓練、推論及AI Agent部署,以擴大在AI基礎設施與應用服務價值鏈中的參與範圍。
展望後續,亞灣超算表示,將持續在亞太地區擴充由NVIDIA Blackwell及Vera Rubin架構驅動的AI基礎設施,並結合鴻海在關鍵零組件、系統製造及供應鏈整合方面的資源。
隨著首座5MW集群以超過9成使用率投入商業營運,後續市場也將關注亞灣超算新增算力及亞太據點的建置進度,以及其營運模式能否由GPU租賃,進一步擴展至模型、平台及企業AI Agent部署服務。
FACT BOX · 重點整理
- 來源:PR Times
- 分類:新品
- 相關組織:NVIDIA
- 原文日期:31日
- 產品、服務:NVIDIA HGX B300 AI集群 / Tokenized AI Factory