B3008.70$/h
288GB
$0.23
H2003.78$/h
141GB
$1.07
RTXPro60002.15$/h
96GB
$0.26
A100_80G1.49$/h
80GB
$0.03
H1002.75$/h
80GB
$0.56
A60000.55$/h
48GB
$0.08
L400.97$/h
48GB
$0.13
L40S0.97$/h
48GB
$0.21
RTX6000Ada1.07$/h
48GB
$0.66
A1001.50$/h
40GB
$0.04
V100_32G2.57$/h
32GB
$0.00
RTX50900.77$/h
32GB
$0.06
RTX40900.44$/h
24GB
$0.22
L41.05$/h
24GB
$0.00
A101.42$/h
24GB
$0.00
A50001.56$/h
24GB
$0.00
A160.56$/h
16GB
$0.00
A40000.88$/h
16GB
$0.71
V1002.57$/h
16GB
$2.15
CPU0.39$/h
0GB
$0.00
Inference
Quickly deploy a public or custom model to a dedicated inference endpoint.
- Model
- Name