Faites tourner n'importe quel modèle d'AI pour moins cher.
Trouvez le moyen le moins cher de faire tourner le modèle dont vous avez besoin — une API hébergée, un GPU loué ou un nœud entier. Prix en direct des clouds GPU et des fournisseurs d'API d'AI, associés aux modèles qu'ils peuvent exécuter.
Les modèles populaires, et ce qu'ils coûtent à faire tourner.
Tous les modèles d'AI →Pour chaque modèle : l'API hébergée la moins chère, et le GPU unique le moins cher qui le contient en 4 bits — aux prix du jour.
Choisissez un GPU selon ce qu'il doit contenir.
Vérifier un modèle précis →La mémoire détermine les modèles qu'un GPU peut exécuter ; le prix, ce que vous payez. Voici les cartes les moins chères de chaque classe de mémoire en ce moment.
Modèles 7–8B en pleine précision, 14B en 8 bits, ~32B en 4 bits. Génération d'images.
Modèles 70B en 4 bits, 32B en 8 bits. La gamme au meilleur rapport qualité-prix pour les LLM privés.
70B en 8 bits, ~120B en 4 bits, fine-tuning QLoRA de modèles 70B.
70B en pleine précision sur une seule carte ; la brique de base des modèles MoE de la classe DeepSeek.
Qui fait tourner l'AI pour vous.
Clouds et marketplaces GPU
Tout voir →Louez un GPU à l'heure et exécutez-y ce que vous voulez.
API d'AI hébergées
Tout voir →Payez au token des modèles servis par d'autres.
Que construisez-vous ?
Dernières analyses.
Tous les articles →Chaque prix ici provient des offres des fournisseurs eux-mêmes — marketplaces GPU toutes les quelques minutes, clouds à prix fixe et catalogues d'API chaque jour. Les classements se font uniquement au prix ; les liens d'affiliation ne changent jamais l'ordre.