B3008.70$/h
288GB
$0.23
B2007.36$/h
192GB
$0.19
H2004.92$/h
141GB
$0.07
RTXPro60002.15$/h
96GB
$0.26
GAUDI21.21$/h
96GB
$0.00
A100_80G1.49$/h
80GB
$0.55
H1003.52$/h
80GB
$1.33
L400.97$/h
48GB
$0.13
L40S0.97$/h
48GB
$0.21
RTX6000Ada1.07$/h
48GB
$0.66
A402.05$/h
48GB
$0.00
A60002.12$/h
48GB
$1.50
A1001.54$/h
40GB
$0.04
V100_32G2.57$/h
32GB
$0.00
RTX40900.44$/h
24GB
$0.10
L41.05$/h
24GB
$0.00
A101.42$/h
24GB
$0.00
A50001.56$/h
24GB
$0.00
V1000.43$/h
16GB
$2.15
A40000.88$/h
16GB
$0.71
A160.56$/h
16GB
$0.00
CPU0.39$/h
0GB
$0.00
Inference
Quickly deploy a public or custom model to a dedicated inference endpoint.
- Model
- Name