GPU group
Cheap inference.
Mid-range GPUs that run quantized 7B–13B models at the lowest hourly rates.
| GPU | Tier | Architecture | VRAM | From | |
|---|---|---|---|---|---|
| consumer | 12GB | $0.028/hr | Compare → | ||
| workstation | 16GB | $0.042/hr | Compare → | ||
| consumer | 16GB | $0.056/hr | Compare → | ||
| consumer | 12GB | $0.065/hr | Compare → | ||
| consumer | 24GB | $0.071/hr | Compare → | ||
| consumer | 12GB | $0.082/hr | Compare → | ||
| consumer | 16GB | $0.085/hr | Compare → | ||
| consumer | 16GB | $0.087/hr | Compare → | ||
| consumer | 24GB | $0.11/hr | Compare → | ||
| consumer | 16GB | $0.11/hr | Compare → | ||
| workstation | 24GB | $0.15/hr | Compare → | ||
| consumer | 32GB | $0.27/hr | Compare → | ||
| workstation | 48GB | $0.29/hr | Compare → | ||
| workstation | 48GB | $0.53/hr | Compare → | ||
| workstation | 48GB | $0.56/hr | Compare → | ||
| workstation | 96GB | $0.66/hr | Compare → | ||
| workstation | 96GB | $0.74/hr | Compare → | ||
| workstation | 96GB | $1.53/hr | Compare → |
Ad