GPU Comparison

NVIDIA
GEFORCE

NVIDIA B200

CORE STATE GB100
VRAM 90 GB
CLOCK SPEED 1965 MHz
TDP 1000 W
BUS WIDTH 4096 bit
ARCHITECTURE Blackwell
nm
PROCESS 5 nm
LAUNCH DATE
VS
NVIDIA
GEFORCE

Quadro M4000M

CORE STATE GM204
VRAM 4 GB
CLOCK SPEED 1013 MHz
TDP 100 W
BUS WIDTH 256 bit
ARCHITECTURE Maxwell 2.0
nm
PROCESS 28 nm
LAUNCH DATE 2015

PERFORMANCE BENCHMARKS

geekbench_opencl
345,482
19,989
geekbench_vulkan
N/A
20,971

DETAILED SPECIFICATIONS

SPECIFICATION
B200
Quadro M4000M
Core Specs
Shading Units
18,944
1,280 -93.2%
Shaders
18,944
1,280 -93.2%
TMUs
592
80 -86.5%
ROPs
24
64 +166.7%
SM Count
148
Clocks
Base Clock
700 MHz
975 MHz
Boost Clock
1965 MHz
1013 MHz
Memory Clock
2000 MHz 8 Gbps effective
1253 MHz 5 Gbps effective
Memory
Memory Size
90 GB
4 GB
VRAM (MB)
92,160
4,096 -95.6%
Memory Type
HBM3e
GDDR5
Memory Bus
4096 bit
256 bit
Bandwidth
4.10 TB/s
160.4 GB/s
Cache
L1 Cache
256 KB (per SM)
48 KB (per SMM)
L2 Cache
50 MB
2 MB
Performance
Pixel Rate
47.16 GPixel/s
64.83 GPixel/s
Texture Rate
1,163.3 GTexel/s
81.04 GTexel/s
FP32 (TFLOPS)
74.45 TFLOPS
2.593 TFLOPS
FP64 (TFLOPS)
37.22 TFLOPS (1:2)
81.04 GFLOPS (1:32)
FP16 (TFLOPS)
1,191.2 TFLOPS (16:1)
AI/RT
Tensor Cores
592
Power
TDP
1000 W
100 W
TDP (W)
1,000
100 -90.0%
Suggested PSU
1400 W
Power Connectors
None
Architecture
Architecture
Blackwell
Maxwell 2.0
GPU Name
GB100
GM204
Generation
Server Blackwell (Bxx)
Quadro Maxwell-M (Mx000M)
Process Size
5 nm
28 nm
Transistors
104,000 million
5,200 million
Die Size
398 mm²
Foundry
TSMC
TSMC
Density
13.1M / mm²
API Support
DirectX
12 (12_1)
OpenGL
4.6
Vulkan
1.4
OpenCL
3.0
3.0
CUDA
10.0
5.2
Shader Model
6.8
Physical
Slot Width
SXM Module
MXM Module
Outputs
No outputs
Portable Device Dependent
Bus Interface
PCIe 5.0 x16
PCIe 3.0 x16
Other
Production
Active
End-of-life
Predecessor
Server Hopper
Quadro Kepler-M
Successor
Server Rubin
Quadro Pascal-M
View B200 Details View Quadro M4000M Details