Modelos de AI · GPU · proveedores

Ejecuta cualquier modelo de AI por menos.

Encuentra la forma más barata de ejecutar el modelo que necesitas: una API alojada, una GPU alquilada o un nodo completo. Precios en vivo de nubes de GPU y proveedores de API de AI, emparejados con los modelos que pueden ejecutar.

Ahora mismo: H100 desde $0.99/hr · RTX 4090 desde $0.18/hr · actualizado hace 2 minutes
01Modelos populares

Modelos populares y cuánto cuesta ejecutarlos.

Todos los modelos de AI →

Para cada modelo: la API alojada más barata y la GPU individual más barata que lo admite a 4 bits, ambas a precios de hoy.

Llama 3.3 70B Instruct
Meta AI · 70B parámetros
API alojada
$0.32 / 1M tokens de salida · OpenRouter
Tu propia GPU (necesita ~44 GB)
Nvidia RTX A6000 $0.32/hr · Nosana
DeepSeek R1
DeepSeek · 671B parámetros
API alojada
$2.19 / 1M tokens de salida · DeepSeek API
Tu propia GPU (necesita ~395 GB)
Necesita un nodo multi-GPU
Qwen2.5 72B Instruct
Alibaba (Qwen Team) · 72B parámetros
API alojada
$0.40 / 1M tokens de salida · DeepInfra
Tu propia GPU (necesita ~45 GB)
Nvidia RTX A6000 $0.32/hr · Nosana
GPT-OSS 120B
OpenAI · 120B parámetros
API alojada
$0.17 / 1M tokens de salida · DeepInfra
Tu propia GPU (necesita ~75 GB)
Nvidia H200 NVL $0.50/hr · RunPod
Gemma 3 27B It
Google DeepMind · 27B parámetros
API alojada
$0.16 / 1M tokens de salida · DeepInfra
Tu propia GPU (necesita ~17 GB)
Nvidia L4 $0.083/hr · Clore.ai
Qwen 2.5 Coder 32B Instruct
Alibaba (Qwen Team) · 32B parámetros
API alojada
$0.80 / 1M tokens de salida · Together AI
Tu propia GPU (necesita ~20 GB)
Nvidia L4 $0.083/hr · Clore.ai
GPT-OSS 20B
OpenAI · 20B parámetros
API alojada
$0.09 / 1M tokens de salida · OpenRouter
Tu propia GPU (necesita ~13 GB)
Nvidia RTX A4000 $0.048/hr · Clore.ai
Qwen3 32B
Alibaba (Qwen Team) · 32B parámetros
API alojada
$0.28 / 1M tokens de salida · Alibaba DashScope
Tu propia GPU (necesita ~20 GB)
Nvidia L4 $0.083/hr · Clore.ai
02GPU para AI

Elige una GPU según lo que necesites que quepa.

Comprobar un modelo concreto →

La memoria decide qué modelos puede ejecutar una GPU; el precio decide cuánto pagas. Estas son las tarjetas más baratas de cada clase de memoria ahora mismo.

16–24 GB

Modelos de 7–8B a precisión completa, 14B a 8 bits, ~32B a 4 bits. Generación de imágenes.

RTX A4000 $0.048/hr
RTX 4070 Ti SUPER $0.069/hr
Tesla T4 $0.083/hr
23 tipos de GPU en esta clase
32–48 GB

Modelos de 70B a 4 bits, 32B a 8 bits. La gama con mejor relación calidad-precio para LLM privados.

RTX A6000 $0.32/hr
17 tipos de GPU en esta clase
80–96 GB

70B a 8 bits, ~120B a 4 bits, ajuste fino QLoRA de modelos de 70B.

A100 80GB PCIe $0.65/hr
15 tipos de GPU en esta clase
141 GB o más

70B a precisión completa en una sola tarjeta; la base para modelos MoE de la clase DeepSeek.

H200 NVL $0.50/hr
AMD MI300X $0.50/hr
H200 $2.95/hr
8 tipos de GPU en esta clase
03Proveedores

Quién ejecuta la AI por ti.

Nubes y marketplaces de GPU

Ver todo →

Alquila una GPU por horas y ejecuta lo que quieras.

Clore.ai 59 tipos de GPU · desde $0.018/hr
RunPod 44 tipos de GPU · desde $0.12/hr
Theta EdgeCloud 34 tipos de GPU · desde $0.072/hr
Nosana 20 tipos de GPU · desde $0.038/hr
Lium 18 tipos de GPU · desde $0.12/hr
Spheron Network 18 tipos de GPU · desde $0.54/hr

API de AI alojadas

Ver todo →

Paga por token por modelos que sirve otro.

OpenRouter 456 modelos con precio
DeepInfra 132 modelos con precio
Together AI 89 modelos con precio
OpenAI API 60 modelos con precio
Alibaba DashScope 46 modelos con precio
Mistral La Plateforme 24 modelos con precio

Cada precio aquí procede de las propias ofertas de los proveedores: marketplaces de GPU cada pocos minutos, nubes de precio fijo y catálogos de API a diario. Las clasificaciones son solo por precio; los enlaces de afiliado nunca cambian el orden.