过去两年,企业对大模型的态度从“试试看”转向“算总账”。当开源权重模型在通用能力上逐步逼近闭源旗舰,一个现实问题浮出水面:既然可以自己微调,为什么还要按调用量付费给闭源API?答案并不像表面那么简单。
开源模型的能力拐点已到
开源社区迭代速度惊人,主流开源模型的推理、指令遵循和多语言能力持续提升。在很多垂直任务上,经过微调的开源模型已经不输通用闭源模型。更重要的是,权重可下载意味着数据不出内网,模型可以长期冻结版本、反复调试。
对金融、医疗、制造等数据敏感行业,这一点几乎是决定性的。它们不需要模型会写诗,只需要它在特定业务口径上稳定可靠。
微调的成本并不是零
自建微调的账本远不止算力费用。数据清洗与标注、评测体系搭建、推理服务的扩缩容、版本管理和线上监控,都是持续性投入。团队如果缺乏机器学习工程能力,隐性成本可能高于API账单。
此外,开源模型的许可证条款、商用边界和后续安全补丁也需要法务与安全团队评估。自建的代价是掌控力,换来的是责任。
闭源API仍守住三块阵地
第一是能力上限。在最复杂的推理、长上下文和工具调用场景,闭源旗舰模型仍有优势,且厂商会持续推送升级,企业无需自己追赶。
第二是工程便利。弹性扩容、多区域部署、可观测性、服务等级保障,这些“脏活”由厂商承担,团队可以专注业务逻辑。
第三是生态与合规配套。内容安全、审计日志、企业级身份管理等能力,往往已经打包进平台。
2026年的主流答案:混合架构
更可能的图景不是“抛弃”,而是分层:高频、标准化、数据敏感的任务交给微调后的开源模型;低频、高难度、快速变化的场景继续调用闭源API。
- 入口用小模型做意图识别与路由,控制成本;
- 核心业务用私有化开源模型保证数据边界;
- 疑难请求上升到闭源API,保证体验上限。
这种架构让企业既握有议价权,也保留了能力天花板。
企业该怎么判断
可以问三个问题:数据是否允许出境或上云?任务分布是否足够稳定以支撑微调收益?团队是否具备长期运维模型的能力?三个答案都肯定,自建微调就更划算;否则,闭源API仍是更省心的选择。
归根结底,开源与闭源不是路线之争,而是成本、可控性与能力上限之间的权衡。下半场比的是谁能把两者组合得更好,而不是谁彻底取代谁。