「开源模型能不能打」这个问题在 2026 年已经有了新答案:不是能不能打,而是选哪个打。开放权重阵营的旗手密度前所未有——GLM-5、Qwen3.5、DeepSeek V3.2、Kimi K2 系在推理、代码、智能体任务上轮番与闭源旗舰掰手腕,许可证也从「社区许可加限制条款」进化到 MIT/Apache 2.0 的干净姿态。本文做一张截至 2026-10-07 的全景对照图(许可证解读可先读站内《开源大模型的 License 地图》)。
六大家现状速览
DeepSeek(深度求索):V3.2 是自托管口碑最稳的开放权重模型之一(671B 总参、约 37B 激活的 MoE,稀疏注意力 DSA 压推理成本),权重 MIT。社区口碑集中在一个词:便宜——同档能力下每 token 成本长期是阵营底线。
Qwen(通义千问):Qwen3.5 旗舰 397B-A17B MoE(2026 年 2 月发布)以 Apache 2.0 开放,多尺寸家族齐全(4B 到旗舰),语言覆盖与多模态配套是同类最全。生态位:全尺寸梯队的默认选项,从手机端到集群都有的选。
GLM(智谱 Z.ai):GLM-5(2026 年 2 月开源,744B,MIT)之后节奏极快——GLM-5.1(4 月,长时程任务)、GLM-5.2(6 月)、GLM-5.3 主打编码。Z.ai 自 2025 年 7 月起全线 MIT,是阵营里许可证最干净的一家。生态位:编码与智能体长任务。
Kimi(月之暗面):K2(1T 总参、32B 激活,Modified MIT——月活超 1 亿的商用需额外协议)到 K2 Thinking 主打推理与 Agentic,被多家评测机构称为发布时点最强的开放权重推理模型,2026 年迭代到 K2.5/K2.6。生态位:工具调用与长程推理。
Meta Llama 4:Scout/Maverick 两档(MoE,2025 年 4 月)延续「Llama Community License」——名义开放但有 7 亿月活企业需单独授权、品牌使用条款与欧盟使用限制。2025–2026 年它的相对位置下滑:榜单上前排被中国模型与 Mistral 挤压,但生态惯性(工具链支持、企业既有部署)仍最大。
Mistral:Apache 2.0 阵营的欧洲代表,Small 系全开源,Large 3 进入 vLLM 支持列表。生态位:欧洲合规叙事 + 干净许可证 + 中小尺寸高性价比。
许可证对照:商用前的第一道检查
| 模型家族 | 最新开放版本(截至 2026-10) | 许可证 | 商用注意 |
|---|---|---|---|
| DeepSeek | V3.2 | MIT | 基本无限制 |
| Qwen | Qwen3.5(397B-A17B 及小尺寸) | Apache 2.0 | 需保留声明与 NOTICE |
| GLM | GLM-5.3 / 5.2 / 5.1 / 5 | MIT | 基本无限制 |
| Kimi | K2 系 | Modified MIT | 月活 >1 亿需与月之暗面另行协议 |
| Llama | Llama 4 | Community License | 7 亿月活门槛、品牌条款、欧盟限制 |
| Mistral | Large 3 / Small 系 | Apache 2.0(Small 系) | Large 系核对具体条款 |
一句话原则:MIT/Apache 意味着许可证不再是选型变量,可以把注意力全放在能力与成本上;带限制条款的(Kimi、Llama)则要把阈值写进法务清单。
部署成本:看激活参数,不只看总参
开放权重 MoE 时代的部署账本有两个数字:总参数决定权重文件多大(显存放不放得下),激活参数决定每 token 跑多贵(吞吐与延迟)。几个实用的量级感:
- 全量自托管 671B–1T 级模型(DeepSeek V3.2、GLM-5、Kimi K2):权重文件数百 GB 起,多卡服务器(8×H100/H200 或更多)起步,适合有团队与流量的场景;
- 激活 17B–37B 的 MoE 是性价比甜区:Qwen3.5-397B-A17B、Kimi K2 的成本优势正来自「总参大、激活小」;
- 中小尺寸 dense 模型(Qwen3.5-4B、Mistral Small 系、GLM 小尺寸)是单卡/笔记本档,配合量化(INT4 起步)即可服务,微调试错也便宜——工具链见站内《LlamaFactory 上手》与《Ollama 实战指南》。
场景选型建议
- 自托管推理服务(有 GPU 预算、要数据主权):DeepSeek V3.2 与 Qwen3.5 旗舰是两个安全答案——前者成本口碑最好,后者尺寸梯队全、Apache 2.0 无心智负担。vLLM/SGLang 对四家支持都已成熟(部署参考站内《vLLM 与 PagedAttention》《SGLang 上手》);
- 垂直领域微调:从 30B 级以下的小尺寸起步(Qwen3.5 小档、Mistral Small、GLM 小尺寸),数据工程做好比换底座更有效(见站内《微调的数据工程》);
- 企业集成(不想养 GPU):开源模型的价值在于「可迁移性」——用哪家 API 都行,但选 MIT/Apache 的开放权重模型作能力基线,随时可以把业务搬回自己的机器,这是对供应商锁定的对冲;
- 编码/智能体重负载:GLM-5.3 与 Kimi K2 系是开放阵营当前的先锋位,选型前用自己的工作流实测,榜单只做初筛。
结语
2026 年开放权重阵营的真正变化,是把「追赶」叙事换成了「并行」:能力上与闭源旗舰互有胜负,许可证上反而更干净,成本上长期占优。选型问题从「要不要用开源」变成了「在哪个环节用、用哪家」——而这正是这个生态健康度最好的证明。
读者留言
COMMENTS 暂无还没有留言,来说第一句?