Modèles d'AI · GPU · fournisseurs

Faites tourner n'importe quel modèle d'AI pour moins cher.

Trouvez le moyen le moins cher de faire tourner le modèle dont vous avez besoin — une API hébergée, un GPU loué ou un nœud entier. Prix en direct des clouds GPU et des fournisseurs d'API d'AI, associés aux modèles qu'ils peuvent exécuter.

En ce moment : H100 dès $0.99/hr · RTX 4090 dès $0.18/hr · mis à jour il y a 2 minutes
01Modèles populaires

Les modèles populaires, et ce qu'ils coûtent à faire tourner.

Tous les modèles d'AI →

Pour chaque modèle : l'API hébergée la moins chère, et le GPU unique le moins cher qui le contient en 4 bits — aux prix du jour.

Llama 3.3 70B Instruct
Meta AI · 70B paramètres
API hébergée
$0.32 / 1M tokens en sortie · OpenRouter
Votre propre GPU (~44 GB requis)
Nvidia RTX A6000 $0.32/hr · Nosana
DeepSeek R1
DeepSeek · 671B paramètres
API hébergée
$2.19 / 1M tokens en sortie · DeepSeek API
Votre propre GPU (~395 GB requis)
Nécessite un nœud multi-GPU
Qwen2.5 72B Instruct
Alibaba (Qwen Team) · 72B paramètres
API hébergée
$0.40 / 1M tokens en sortie · DeepInfra
Votre propre GPU (~45 GB requis)
Nvidia RTX A6000 $0.32/hr · Nosana
GPT-OSS 120B
OpenAI · 120B paramètres
API hébergée
$0.17 / 1M tokens en sortie · DeepInfra
Votre propre GPU (~75 GB requis)
Nvidia H200 NVL $0.50/hr · RunPod
Gemma 3 27B It
Google DeepMind · 27B paramètres
API hébergée
$0.16 / 1M tokens en sortie · DeepInfra
Votre propre GPU (~17 GB requis)
Nvidia L4 $0.083/hr · Clore.ai
Qwen 2.5 Coder 32B Instruct
Alibaba (Qwen Team) · 32B paramètres
API hébergée
$0.80 / 1M tokens en sortie · Together AI
Votre propre GPU (~20 GB requis)
Nvidia L4 $0.083/hr · Clore.ai
GPT-OSS 20B
OpenAI · 20B paramètres
API hébergée
$0.09 / 1M tokens en sortie · OpenRouter
Votre propre GPU (~13 GB requis)
Nvidia RTX A4000 $0.048/hr · Clore.ai
Qwen3 32B
Alibaba (Qwen Team) · 32B paramètres
API hébergée
$0.28 / 1M tokens en sortie · Alibaba DashScope
Votre propre GPU (~20 GB requis)
Nvidia L4 $0.083/hr · Clore.ai
02GPU pour l'AI

Choisissez un GPU selon ce qu'il doit contenir.

Vérifier un modèle précis →

La mémoire détermine les modèles qu'un GPU peut exécuter ; le prix, ce que vous payez. Voici les cartes les moins chères de chaque classe de mémoire en ce moment.

16–24 GB

Modèles 7–8B en pleine précision, 14B en 8 bits, ~32B en 4 bits. Génération d'images.

RTX A4000 $0.048/hr
RTX 4070 Ti SUPER $0.069/hr
Tesla T4 $0.083/hr
23 types de GPU dans cette classe
32–48 GB

Modèles 70B en 4 bits, 32B en 8 bits. La gamme au meilleur rapport qualité-prix pour les LLM privés.

RTX A6000 $0.32/hr
17 types de GPU dans cette classe
80–96 GB

70B en 8 bits, ~120B en 4 bits, fine-tuning QLoRA de modèles 70B.

A100 80GB PCIe $0.65/hr
15 types de GPU dans cette classe
141 GB et plus

70B en pleine précision sur une seule carte ; la brique de base des modèles MoE de la classe DeepSeek.

H200 NVL $0.50/hr
AMD MI300X $0.50/hr
H200 $2.95/hr
8 types de GPU dans cette classe
03Fournisseurs

Qui fait tourner l'AI pour vous.

Clouds et marketplaces GPU

Tout voir →

Louez un GPU à l'heure et exécutez-y ce que vous voulez.

Clore.ai 59 types de GPU · dès $0.018/hr
RunPod 44 types de GPU · dès $0.12/hr
Theta EdgeCloud 34 types de GPU · dès $0.072/hr
Nosana 20 types de GPU · dès $0.038/hr
Lium 18 types de GPU · dès $0.12/hr
Spheron Network 18 types de GPU · dès $0.54/hr

API d'AI hébergées

Tout voir →

Payez au token des modèles servis par d'autres.

OpenRouter 456 modèles avec prix
DeepInfra 132 modèles avec prix
Together AI 89 modèles avec prix
OpenAI API 60 modèles avec prix
Alibaba DashScope 46 modèles avec prix
Mistral La Plateforme 24 modèles avec prix

Chaque prix ici provient des offres des fournisseurs eux-mêmes — marketplaces GPU toutes les quelques minutes, clouds à prix fixe et catalogues d'API chaque jour. Les classements se font uniquement au prix ; les liens d'affiliation ne changent jamais l'ordre.