GPU group

Cheap inference.

Mid-range GPUs that run quantized 7B–13B models at the lowest hourly rates.

GPU VRAM From
12GB $0.028/hr Compare →
16GB $0.042/hr Compare →
16GB $0.048/hr Compare →
12GB $0.065/hr Compare →
24GB $0.071/hr Compare →
12GB $0.082/hr Compare →
16GB $0.085/hr Compare →
16GB $0.087/hr Compare →
24GB $0.11/hr Compare →
16GB $0.11/hr Compare →
24GB $0.15/hr Compare →
32GB $0.27/hr Compare →
48GB $0.29/hr Compare →
48GB $0.53/hr Compare →
48GB $0.56/hr Compare →
96GB $0.66/hr Compare →
96GB $0.74/hr Compare →
96GB $1.53/hr Compare →