HPC
High-Performance Computing (高效能運算)
定義
- 核心概念:整合 大量運算、儲存、網路資源,在短時間內完成高複雜度工作負載。
- 產業語境:在 半導體、伺服器、資料中心 討論中,HPC 常泛指需要高算力的應用。
- 如:科學模擬、AI 訓練、AI 推論。
核心組成
- 運算資源:以 CPU、GPU、ASIC、其他加速器為核心,負責平行處理大量任務。
- 儲存系統:提供高吞吐、低延遲的資料讀寫能力,避免運算節點閒置。
- 高速互連:負責節點、儲存設備之間的快速資料交換,決定整體擴充效率。
- 軟體調度:透過平行運算框架、叢集管理、工作排程,讓多台機器協同執行。
主要應用
- 科學研究:用於氣象預測、天文模擬、生物基因分析、藥物研發。
- 工程模擬:用於飛機設計、車輛碰撞測試、流體模擬、材料分析。
- AI 運算:用於大型模型訓練、推論服務、資料中心算力部署。
- 商業分析:用於金融風險模型、供應鏈最佳化、巨量資料分析。
關鍵技術
- 平行運算:把單一問題拆成多個子任務,同步處理以提升效能。
- 分散式運算:將工作分配到多個節點,擴大總算力與可處理資料量。
- 異質運算:依工作特性分配給不同處理器,兼顧速度、能效、成本。
- 雲端化:透過雲端/混合架構提供彈性算力,降低自建超級電腦門檻。
名詞辨識
- 與超級電腦差異:超級電腦是硬體系統,HPC 是整體運算模式與能力需求。
- 與 AI 伺服器差異:AI 伺服器是 HPC 的重要場景之一,但 HPC 不只限於 AI。
- 與雲端運算差異:雲端運算是資源交付方式,HPC 是工作負載特性,兩者可以重疊。
發展方向
- AI 融合:生成式 AI 帶動 HPC 對加速器、記憶體頻寬、先進封裝的需求上升。
- 異質架構:CPU、GPU、ASIC、DPU 分工愈來愈細,系統設計更重視協同效率。
- 能效優先:高功耗限制下,效能/瓦數與散熱能力成為關鍵指標。