AI-Modelle · GPUs · Anbieter

Jedes AI-Modell betreiben – für weniger.

Finden Sie den günstigsten Weg, das Modell zu betreiben, das Sie brauchen — eine gehostete API, eine gemietete GPU oder ein ganzer Node. Live-Preise von GPU-Clouds und AI-API-Anbietern, abgeglichen mit den Modellen, die sie ausführen können.

Aktuell: H100 ab $0.99/hr · RTX 4090 ab $0.18/hr · vor 2 minutes aktualisiert
01Beliebte Modelle

Beliebte Modelle und was ihr Betrieb kostet.

Alle AI-Modelle →

Für jedes Modell: die günstigste gehostete API und die günstigste einzelne GPU, die es in 4-Bit fasst — beides zu heutigen Preisen.

Llama 3.3 70B Instruct
Meta AI · 70B Parameter
Gehostete API
$0.32 / 1 Mio. Output-Tokens · OpenRouter
Eigene GPU (braucht ~44 GB)
Nvidia RTX A6000 $0.32/hr · Nosana
DeepSeek R1
DeepSeek · 671B Parameter
Gehostete API
$2.19 / 1 Mio. Output-Tokens · DeepSeek API
Eigene GPU (braucht ~395 GB)
Braucht einen Multi-GPU-Node
Qwen2.5 72B Instruct
Alibaba (Qwen Team) · 72B Parameter
Gehostete API
$0.40 / 1 Mio. Output-Tokens · DeepInfra
Eigene GPU (braucht ~45 GB)
Nvidia RTX A6000 $0.32/hr · Nosana
GPT-OSS 120B
OpenAI · 120B Parameter
Gehostete API
$0.17 / 1 Mio. Output-Tokens · DeepInfra
Eigene GPU (braucht ~75 GB)
Nvidia H200 NVL $0.50/hr · RunPod
Gemma 3 27B It
Google DeepMind · 27B Parameter
Gehostete API
$0.16 / 1 Mio. Output-Tokens · DeepInfra
Eigene GPU (braucht ~17 GB)
Nvidia L4 $0.083/hr · Clore.ai
Qwen 2.5 Coder 32B Instruct
Alibaba (Qwen Team) · 32B Parameter
Gehostete API
$0.80 / 1 Mio. Output-Tokens · Together AI
Eigene GPU (braucht ~20 GB)
Nvidia L4 $0.083/hr · Clore.ai
GPT-OSS 20B
OpenAI · 20B Parameter
Gehostete API
$0.09 / 1 Mio. Output-Tokens · OpenRouter
Eigene GPU (braucht ~13 GB)
Nvidia RTX A4000 $0.048/hr · Clore.ai
Qwen3 32B
Alibaba (Qwen Team) · 32B Parameter
Gehostete API
$0.28 / 1 Mio. Output-Tokens · Alibaba DashScope
Eigene GPU (braucht ~20 GB)
Nvidia L4 $0.083/hr · Clore.ai
02GPUs für AI

Wählen Sie die GPU nach dem, was hineinpassen muss.

Ein bestimmtes Modell prüfen →

Der Speicher entscheidet, welche Modelle eine GPU ausführen kann; der Preis, was Sie zahlen. Hier sind die aktuell günstigsten Karten jeder Speicherklasse.

16–24 GB

7–8B-Modelle in voller Präzision, 14B in 8-Bit, ~32B in 4-Bit. Bildgenerierung.

RTX A4000 $0.048/hr
RTX 4070 Ti SUPER $0.069/hr
Tesla T4 $0.083/hr
23 GPU-Typen in dieser Klasse
32–48 GB

70B-Modelle in 4-Bit, 32B in 8-Bit. Die Preis-Leistungs-Klasse für private LLMs.

RTX A6000 $0.32/hr
17 GPU-Typen in dieser Klasse
80–96 GB

70B in 8-Bit, ~120B in 4-Bit, QLoRA-Fine-Tuning von 70B-Modellen.

A100 80GB PCIe $0.65/hr
15 GPU-Typen in dieser Klasse
141 GB und mehr

70B in voller Präzision auf einer Karte; der Baustein für MoE-Modelle der DeepSeek-Klasse.

H200 NVL $0.50/hr
AMD MI300X $0.50/hr
H200 $2.95/hr
8 GPU-Typen in dieser Klasse
03Anbieter

Wer AI für Sie betreibt.

GPU-Clouds & Marktplätze

Alle ansehen →

Mieten Sie eine GPU stundenweise und führen Sie darauf aus, was Sie wollen.

Clore.ai 59 GPU-Typen · ab $0.018/hr
RunPod 44 GPU-Typen · ab $0.12/hr
Theta EdgeCloud 34 GPU-Typen · ab $0.072/hr
Nosana 20 GPU-Typen · ab $0.038/hr
Lium 18 GPU-Typen · ab $0.12/hr
Spheron Network 18 GPU-Typen · ab $0.54/hr

Gehostete AI-APIs

Alle ansehen →

Bezahlen Sie pro Token für Modelle, die jemand anderes bereitstellt.

OpenRouter 456 Modelle mit Preis
DeepInfra 132 Modelle mit Preis
Together AI 89 Modelle mit Preis
OpenAI API 60 Modelle mit Preis
Alibaba DashScope 46 Modelle mit Preis
Mistral La Plateforme 24 Modelle mit Preis

Jeder Preis hier stammt aus den eigenen Angeboten der Anbieter — GPU-Marktplätze alle paar Minuten, Festpreis-Clouds und API-Kataloge täglich. Rankings richten sich nur nach dem Preis; Affiliate-Links ändern die Reihenfolge nie.