← 返回 ModelX 首页

开源大模型本地部署排行榜

按参数量分档 · 含上下文与 API 参考价 · 数据每日自动更新

UPDATED 2026-09-22 · SOURCE OpenRouter API

≤16B · 轻薄级(笔记本/小显存可跑)

#模型参数上下文输入 $/M输出 $/M
1granite-4.2-8b8B131K$0.06$0.25
2qwen3.5-9b9B262K$0.1$0.15
3ministral-14b-251214B262K$0.2$0.2
4ministral-8b-25128B262K$0.15$0.15
5ministral-3b-25123B131K$0.1$0.1
6qwen3-vl-8b-thinking8B131K$0.18$2.1
7qwen3-vl-8b-instruct8B262K$0.12$0.45
8llama-guard-4-12b12B163K$0.18$0.18

≤35B · 主流级(24G 单卡甜点)

#模型参数上下文输入 $/M输出 $/M
1Qwen3.8 27B27B1000K$0.42$3
2Nemotron-3 Nano Omni 30B (A3B)免费30B256K免费免费
3qwen3.6-35b-a3b35B262K$0.15$1
4qwen3.6-27b27B262K$0.3$2
5gemma-4-26b-a4b-it26B262K$0.09$0.3
6gemma-4-31b-it31B262K$0.09$0.34
7qwen3.5-35b-a3b35B262K$0.31$1.25
8qwen3.5-27b27B262K$0.2$1.56

≤75B · 工作站级(多卡/A100)

#模型参数上下文输入 $/M输出 $/M
1qwen2.5-vl-72b-instruct72B128K$0.8$1
2deepseek-r1-distill-llama-70b70B8K$0.8$0.8
3llama-3.3-70b-instruct70B131K$0.1$0.32
4qwen-2.5-72b-instruct72B32K$0.36$0.4
5llama-3.1-70b-instruct70B131K$0.4$0.4

≤128B · MoE 高效级

#模型参数上下文输入 $/M输出 $/M
1Nemotron-3 Super 120B (A12B)120B262K$0.08$0.45
2qwen3.5-122b-a10b122B262K$0.26$2.08
3qwen3-next-80b-a3b-thinking80B262K$0.15$1.2
4qwen3-next-80b-a3b-instruct80B262K$0.09$1.1
5gpt-oss-120b120B131K$0.15$0.6

≤260B · 旗舰 MoE

#模型参数上下文输入 $/M输出 $/M
1qwen3-vl-235b-a22b-thinking235B131K$0.4$4
2qwen3-vl-235b-a22b-instruct235B262K$0.21$1.9
3qwen3-235b-a22b-thinking-2507235B131K$0.23$2.3
4qwen3-235b-a22b-2507235B262K$0.09$0.35
5qwen3-235b-a22b235B131K$0.45$1.82

>260B · 超大杯

#模型参数上下文输入 $/M输出 $/M
1Qwen3.8 2.4T (A95B)2400B1048K$2$6
2Nemotron-3 Ultra 550B (A55B)550B262K$0.6$2.4
3qwen3.5-397b-a17b397B262K$0.55$3.5
选型建议:预算有限先用 ≤16B 档(12G 显存可跑,ollama 一键部署);追求质量与成本平衡选 ≤35B MoE 档(激活参数小、单卡 24G 流畅);企业知识库问答推荐 ≤75B 或 MoE 旗舰档。不确定选哪个?微信咨询,免费帮你评估硬件与模型匹配度 → 返回首页扫码