Mô hình AI · GPU · nhà cung cấp

Chạy mọi mô hình AI với chi phí thấp hơn.

Tìm cách rẻ nhất để chạy mô hình bạn cần — API được lưu trữ sẵn, thuê một GPU hay cả một node. Giá trực tiếp từ các đám mây GPU và nhà cung cấp API AI, đối chiếu với các mô hình mà chúng chạy được.

Ngay lúc này: H100 từ $0.99/hr · RTX 4090 từ $0.18/hr · cập nhật 2 minutes trước
01Mô hình phổ biến

Các mô hình phổ biến và chi phí để chạy chúng.

Tất cả mô hình AI →

Với mỗi mô hình: API được lưu trữ rẻ nhất, và GPU đơn rẻ nhất chứa được nó ở 4-bit — đều theo giá hôm nay.

Llama 3.3 70B Instruct
Meta AI · 70B tham số
API lưu trữ sẵn
$0.32 / 1M token đầu ra · OpenRouter
GPU riêng của bạn (cần ~44 GB)
Nvidia RTX A6000 $0.32/hr · Nosana
DeepSeek R1
DeepSeek · 671B tham số
API lưu trữ sẵn
$2.19 / 1M token đầu ra · DeepSeek API
GPU riêng của bạn (cần ~395 GB)
Cần node nhiều GPU
Qwen2.5 72B Instruct
Alibaba (Qwen Team) · 72B tham số
API lưu trữ sẵn
$0.40 / 1M token đầu ra · DeepInfra
GPU riêng của bạn (cần ~45 GB)
Nvidia RTX A6000 $0.32/hr · Nosana
GPT-OSS 120B
OpenAI · 120B tham số
API lưu trữ sẵn
$0.17 / 1M token đầu ra · DeepInfra
GPU riêng của bạn (cần ~75 GB)
Nvidia H200 NVL $0.50/hr · RunPod
Gemma 3 27B It
Google DeepMind · 27B tham số
API lưu trữ sẵn
$0.16 / 1M token đầu ra · DeepInfra
GPU riêng của bạn (cần ~17 GB)
Nvidia L4 $0.083/hr · Clore.ai
Qwen 2.5 Coder 32B Instruct
Alibaba (Qwen Team) · 32B tham số
API lưu trữ sẵn
$0.80 / 1M token đầu ra · Together AI
GPU riêng của bạn (cần ~20 GB)
Nvidia L4 $0.083/hr · Clore.ai
GPT-OSS 20B
OpenAI · 20B tham số
API lưu trữ sẵn
$0.09 / 1M token đầu ra · OpenRouter
GPU riêng của bạn (cần ~13 GB)
Nvidia RTX A4000 $0.048/hr · Clore.ai
Qwen3 32B
Alibaba (Qwen Team) · 32B tham số
API lưu trữ sẵn
$0.28 / 1M token đầu ra · Alibaba DashScope
GPU riêng của bạn (cần ~20 GB)
Nvidia L4 $0.083/hr · Clore.ai
02GPU cho AI

Chọn GPU theo dung lượng bạn cần.

Kiểm tra một mô hình cụ thể →

Bộ nhớ quyết định GPU chạy được mô hình nào; giá quyết định bạn trả bao nhiêu. Đây là những card rẻ nhất trong từng phân khúc bộ nhớ lúc này.

16–24 GB

Mô hình 7–8B ở độ chính xác đầy đủ, 14B ở 8-bit, ~32B ở 4-bit. Tạo ảnh.

RTX A4000 $0.048/hr
RTX 4070 Ti SUPER $0.069/hr
Tesla T4 $0.083/hr
23 loại GPU trong phân khúc này
32–48 GB

Mô hình 70B ở 4-bit, 32B ở 8-bit. Phân khúc đáng tiền cho LLM riêng.

RTX A6000 $0.32/hr
17 loại GPU trong phân khúc này
80–96 GB

70B ở 8-bit, ~120B ở 4-bit, tinh chỉnh QLoRA cho mô hình 70B.

A100 80GB PCIe $0.65/hr
15 loại GPU trong phân khúc này
Từ 141 GB trở lên

70B ở độ chính xác đầy đủ trên một card; nền tảng cho các mô hình MoE cỡ DeepSeek.

H200 NVL $0.50/hr
AMD MI300X $0.50/hr
H200 $2.95/hr
8 loại GPU trong phân khúc này
03Nhà cung cấp

Ai chạy AI cho bạn.

Đám mây & chợ GPU

Xem tất cả →

Thuê GPU theo giờ và chạy bất cứ thứ gì.

Clore.ai 59 loại GPU · từ $0.018/hr
RunPod 44 loại GPU · từ $0.12/hr
Theta EdgeCloud 34 loại GPU · từ $0.072/hr
Nosana 20 loại GPU · từ $0.038/hr
Lium 18 loại GPU · từ $0.12/hr
Spheron Network 18 loại GPU · từ $0.54/hr

API AI lưu trữ sẵn

Xem tất cả →

Trả theo token cho mô hình do bên khác vận hành.

OpenRouter 456 mô hình có giá
DeepInfra 132 mô hình có giá
Together AI 89 mô hình có giá
OpenAI API 60 mô hình có giá
Alibaba DashScope 46 mô hình có giá
Mistral La Plateforme 24 mô hình có giá

Mọi mức giá ở đây đều lấy từ tin đăng của chính nhà cung cấp — chợ GPU cập nhật vài phút một lần, đám mây giá cố định và danh mục API cập nhật hằng ngày. Xếp hạng chỉ theo giá; liên kết tiếp thị không bao giờ thay đổi thứ tự.