GPU 算力對照表
GPU COMPUTE REFERENCE · NVIDIA × AMD
算力中心
自研模型
算力對照表
NVIDIA × AMD 全系列算力對照
資料中心、專業工作站、消費級與邊緣運算 GPU 的算力、顯存、頻寬、功耗與精度支援。 供訓練/推論選型與客戶提案查用;云碩機群現役的型號會標示出來。
數字口徑(比較前請先看這段)
算力一律採
FP16/BF16 dense(稠密)
,
不含 sparsity 加倍
。原廠文宣常標 sparse 值,數字會是這裡的兩倍。
FP8/FP4 欄同樣是 dense 值;標
—
代表該架構沒有原生支援,不是漏填。
Pascal 世代(P100/P40)無 Tensor Core:
P40 的 FP16 只有 FP32 的 1/64 速度
,實務上以 FP32 計算,表中另外註明。
統一記憶體機種(Jetson、DGX Spark、Strix Halo)的「顯存」是與 CPU 共用的容量,頻寬遠低於 HBM,不能直接與獨立顯卡對比。
資料整理自各廠公開規格,
採購與投標前請以原廠 datasheet 為準
。
收錄型號
0
NVIDIA + AMD
最高單卡算力
0
TF
—
云碩現役型號
0
依即時機群資料標記
支援 BF16 訓練
0
可做 bf16-native 微調
全部
NVIDIA
AMD
所有類別
資料中心
工作站
消費級
邊緣
僅 BF16 可訓練
僅云碩現役
—
型號
▼
架構 / 年份
▼
顯存
▼
頻寬
▼
FP16/BF16 dense
▼
FP8
▼
FP4
▼
功耗
▼
能效
▼
精度支援
沒有符合條件的型號