MODELX
用代码解决业务问题 · 数据看板 · Excel 自动化 · AI 落地
0%
MModelX

开源大模型本地部署排行榜

按参数量分档 · 含上下文长度 · 数据每日自动更新

UPDATED 2026-09-24

≤16B · 轻薄级(笔记本/小显存可跑)

#模型参数上下文
1granite-4.2-8b8B131K
2qwen3.5-9b9B262K
3ministral-14b-251214B262K
4ministral-8b-25128B262K
5ministral-3b-25123B131K
6qwen3-vl-8b-thinking8B131K
7qwen3-vl-8b-instruct8B262K
8llama-guard-4-12b12B164K

≤35B · 主流级(24G 单卡甜点)

#模型参数上下文
1Qwen3.8 27B27B1000K
2Nemotron-3 Nano Omni 30B (A3B)免费30B256K
3qwen3.6-35b-a3b35B262K
4qwen3.6-27b27B262K
5gemma-4-26b-a4b-it26B262K
6gemma-4-31b-it31B262K
7qwen3.5-35b-a3b35B262K
8qwen3.5-27b27B262K

≤75B · 工作站级(多卡/A100)

#模型参数上下文
1qwen2.5-vl-72b-instruct72B128K
2deepseek-r1-distill-llama-70b70B8K
3llama-3.3-70b-instruct70B131K
4qwen-2.5-72b-instruct72B33K
5llama-3.1-70b-instruct70B131K

≤128B · MoE 高效级

#模型参数上下文
1Nemotron-3 Super 120B (A12B)120B262K
2qwen3.5-122b-a10b122B262K
3qwen3-next-80b-a3b-thinking80B262K
4qwen3-next-80b-a3b-instruct80B262K
5gpt-oss-120b120B131K

≤260B · 旗舰 MoE

#模型参数上下文
1qwen3-vl-235b-a22b-thinking235B131K
2qwen3-vl-235b-a22b-instruct235B262K
3qwen3-235b-a22b-thinking-2507235B131K
4qwen3-235b-a22b-2507235B262K
5qwen3-235b-a22b235B131K

>260B · 超大杯

#模型参数上下文
1Qwen3.8 2.4T (A95B)2400B1049K
2Nemotron-3 Ultra 550B (A55B)550B262K
3qwen3.5-397b-a17b397B262K
选型建议:预算有限先用 ≤16B 档(12G 显存可跑,ollama 一键部署);追求质量与成本平衡选 ≤35B MoE 档(激活参数小、单卡 24G 流畅);企业知识库问答推荐 ≤75B 或 MoE 旗舰档。 不确定选哪个?微信咨询,免费帮你评估硬件与模型匹配度 → 联系咨询