01热门模型
热门模型及其运行成本。
全部 AI 模型 →每个模型:最便宜的托管 API,以及能以 4-bit 装下它的最便宜单卡 GPU——均按今日价格。
Llama 3.3 70B Instruct
Meta AI · 70B 参数
托管 API
$0.32 / 百万输出 token · OpenRouter
DeepSeek R1
DeepSeek · 671B 参数
托管 API
$2.19 / 百万输出 token · DeepSeek API
自有 GPU(需约 395 GB)
需要多 GPU 节点
Qwen2.5 72B Instruct
Alibaba (Qwen Team) · 72B 参数
托管 API
$0.40 / 百万输出 token · DeepInfra
GPT-OSS 120B
OpenAI · 120B 参数
托管 API
$0.17 / 百万输出 token · DeepInfra
Gemma 3 27B It
Google DeepMind · 27B 参数
托管 API
$0.16 / 百万输出 token · DeepInfra
Qwen 2.5 Coder 32B Instruct
Alibaba (Qwen Team) · 32B 参数
托管 API
$0.80 / 百万输出 token · Together AI
GPT-OSS 20B
OpenAI · 20B 参数
托管 API
$0.09 / 百万输出 token · OpenRouter
Qwen3 32B
Alibaba (Qwen Team) · 32B 参数
托管 API
$0.28 / 百万输出 token · Alibaba DashScope
02AI 用 GPU
按需要装下的模型选择 GPU。
查看具体模型 →显存决定 GPU 能运行哪些模型;价格决定你付多少钱。以下是当前各显存档位中最便宜的显卡。
16–24 GB
7–8B 模型全精度、14B 8-bit、约 32B 4-bit。图像生成。
RTX A4000
$0.048/hr
RTX 4070 Ti SUPER
$0.069/hr
Tesla T4
$0.083/hr
该档位共 23 种 GPU
32–48 GB
70B 模型 4-bit、32B 8-bit。私有 LLM 的高性价比档位。
RTX 5090 Laptop GPU
$0.29/hr
RTX PRO 4500 Blackwell
$0.29/hr
RTX A6000
$0.32/hr
该档位共 17 种 GPU
141 GB 及以上
单卡全精度运行 70B;DeepSeek 级 MoE 模型的基础构件。
H200 NVL
$0.50/hr
AMD MI300X
$0.50/hr
H200
$2.95/hr
该档位共 8 种 GPU
Ad
03服务商
谁来为你运行 AI。
GPU 云与交易市场
查看全部 →按小时租用 GPU,运行任何任务。
Clore.ai
59 种 GPU · 低至 $0.018/hr
RunPod
44 种 GPU · 低至 $0.12/hr
Theta EdgeCloud
34 种 GPU · 低至 $0.072/hr
Nosana
20 种 GPU · 低至 $0.038/hr
Lium
18 种 GPU · 低至 $0.12/hr
Spheron Network
18 种 GPU · 低至 $0.54/hr
托管 AI API
查看全部 →按 token 付费使用他人部署的模型。
OpenRouter
456 个模型已报价
DeepInfra
132 个模型已报价
Together AI
89 个模型已报价
OpenAI API
60 个模型已报价
Alibaba DashScope
46 个模型已报价
Mistral La Plateforme
24 个模型已报价
此处所有价格均来自服务商自己的报价——GPU 交易市场每隔几分钟更新,固定价格云和 API 目录每日更新。排名仅按价格;联盟链接绝不影响排序。