GPU Comparison

NVIDIA
GEFORCE

NVIDIA CMP 90HX

CORE STATE GA102
VRAM 10 GB
CLOCK SPEED 1710 MHz
TDP 320 W
BUS WIDTH 320 bit
ARCHITECTURE Ampere
nm
PROCESS 8 nm
LAUNCH DATE 2021
VS
NVIDIA
GEFORCE

Tesla T4

CORE STATE TU104
VRAM 16 GB
CLOCK SPEED 1590 MHz
TDP 70 W
BUS WIDTH 256 bit
ARCHITECTURE Turing
nm
PROCESS 12 nm
LAUNCH DATE 2018

PERFORMANCE BENCHMARKS

geekbench_opencl
69,000
61,276
geekbench_vulkan
N/A
72,190

DETAILED SPECIFICATIONS

SPECIFICATION
CMP 90HX
Tesla T4
Core Specs
Shading Units
6,400
2,560 -60.0%
Shaders
6,400
2,560 -60.0%
TMUs
200
160 -20.0%
ROPs
80
64 -20.0%
SM Count
50
40 -20.0%
Clocks
Base Clock
1500 MHz
585 MHz
Boost Clock
1710 MHz
1590 MHz
Memory Clock
1188 MHz 19 Gbps effective
1250 MHz 10 Gbps effective
Memory
Memory Size
10 GB
16 GB
VRAM (MB)
10,240
16,384 +60.0%
Memory Type
GDDR6X
GDDR6
Memory Bus
320 bit
256 bit
Bandwidth
760.3 GB/s
320.0 GB/s
Cache
L1 Cache
128 KB (per SM)
64 KB (per SM)
L2 Cache
5 MB
4 MB
Performance
Pixel Rate
136.8 GPixel/s
101.8 GPixel/s
Texture Rate
342.0 GTexel/s
254.4 GTexel/s
FP32 (TFLOPS)
21.89 TFLOPS
8.141 TFLOPS
FP64 (TFLOPS)
342.0 GFLOPS (1:64)
254.4 GFLOPS (1:32)
FP16 (TFLOPS)
21.89 TFLOPS (1:1)
65.13 TFLOPS (8:1)
AI/RT
RT Cores
50
40 -20.0%
Tensor Cores
200
320 +60.0%
Power
TDP
320 W
70 W
TDP (W)
320
70 -78.1%
Suggested PSU
700 W
250 W
Power Connectors
2x 8-pin
None
Architecture
Architecture
Ampere
Turing
GPU Name
GA102
TU104
Generation
Mining GPUs
Tesla Turing (Txx)
Process Size
8 nm
12 nm
Transistors
28,300 million
13,600 million
Die Size
628 mm²
545 mm²
Foundry
Samsung
TSMC
Density
45.1M / mm²
25.0M / mm²
API Support
DirectX
12 Ultimate (12_2)
12 Ultimate (12_2)
OpenGL
4.6
4.6
Vulkan
1.4
1.4
OpenCL
3.0
3.0
CUDA
8.6
7.5
Shader Model
6.8
6.8
Physical
Slot Width
Dual-slot
Single-slot
Length
285 mm 11.2 inches
168 mm 6.6 inches
Height
112 mm 4.4 inches
Outputs
No outputs
No outputs
Bus Interface
PCIe 1.0 x4
PCIe 3.0 x16
Other
Production
End-of-life
End-of-life
Predecessor
Tesla Volta
Successor
Server Ampere
View CMP 90HX Details View Tesla T4 Details