Chạy mọi mô hình AI với chi phí thấp hơn.
Tìm cách rẻ nhất để chạy mô hình bạn cần — API được lưu trữ sẵn, thuê một GPU hay cả một node. Giá trực tiếp từ các đám mây GPU và nhà cung cấp API AI, đối chiếu với các mô hình mà chúng chạy được.
Các mô hình phổ biến và chi phí để chạy chúng.
Tất cả mô hình AI →Với mỗi mô hình: API được lưu trữ rẻ nhất, và GPU đơn rẻ nhất chứa được nó ở 4-bit — đều theo giá hôm nay.
Chọn GPU theo dung lượng bạn cần.
Kiểm tra một mô hình cụ thể →Bộ nhớ quyết định GPU chạy được mô hình nào; giá quyết định bạn trả bao nhiêu. Đây là những card rẻ nhất trong từng phân khúc bộ nhớ lúc này.
Mô hình 7–8B ở độ chính xác đầy đủ, 14B ở 8-bit, ~32B ở 4-bit. Tạo ảnh.
Mô hình 70B ở 4-bit, 32B ở 8-bit. Phân khúc đáng tiền cho LLM riêng.
70B ở 8-bit, ~120B ở 4-bit, tinh chỉnh QLoRA cho mô hình 70B.
70B ở độ chính xác đầy đủ trên một card; nền tảng cho các mô hình MoE cỡ DeepSeek.
Ai chạy AI cho bạn.
Đám mây & chợ GPU
Xem tất cả →Thuê GPU theo giờ và chạy bất cứ thứ gì.
API AI lưu trữ sẵn
Xem tất cả →Trả theo token cho mô hình do bên khác vận hành.
Bạn đang xây dựng gì?
Phân tích mới nhất.
Tất cả bài viết →Mọi mức giá ở đây đều lấy từ tin đăng của chính nhà cung cấp — chợ GPU cập nhật vài phút một lần, đám mây giá cố định và danh mục API cập nhật hằng ngày. Xếp hạng chỉ theo giá; liên kết tiếp thị không bao giờ thay đổi thứ tự.