NVIDIA × AMD 全系列算力對照
資料中心、專業工作站、消費級與邊緣運算 GPU 的算力、顯存、頻寬、功耗與精度支援。
供訓練/推論選型與客戶提案查用;云碩機群現役的型號會標示出來。
數字口徑(比較前請先看這段)
- 算力一律採 FP16/BF16 dense(稠密),不含 sparsity 加倍。原廠文宣常標 sparse 值,數字會是這裡的兩倍。
- FP8/FP4 欄同樣是 dense 值;標 — 代表該架構沒有原生支援,不是漏填。
- Pascal 世代(P100/P40)無 Tensor Core:P40 的 FP16 只有 FP32 的 1/64 速度,實務上以 FP32 計算,表中另外註明。
- 統一記憶體機種(Jetson、DGX Spark、Strix Halo)的「顯存」是與 CPU 共用的容量,頻寬遠低於 HBM,不能直接與獨立顯卡對比。
- 資料整理自各廠公開規格,採購與投標前請以原廠 datasheet 為準。
支援 BF16 訓練
0
可做 bf16-native 微調