如果你最近一两个月没关注开源AI圈,可能会被上新的密度吓一跳。据海外AI资讯平台的统计,近期的模型发布数量以百计,其中开源阵营的几款新品尤其值得中小企业和开发者关注。
一、这波上新,三个方向特别亮眼
方向一:超长上下文成为标配。国内两家公司先后开源或预览了支持百万token上下文的模型:小米的MiMo-V2.6以MIT协议开源——这个协议的宽松程度,意味着企业拿去商用、修改、再分发几乎没有法律包袱;阶跃星辰的Step 5 Preview则以超大参数规模瞄准代码、长文档和专业知识工作场景。百万token意味着什么?一次性读完整本书、整个代码仓库、一整年的合同档案,不再需要切来切去。
方向二:推理成本继续下探。国内头部模型公司上线了速度优化的服务版本,主打高频调用场景的低价策略;海外开源社区也持续输出低成本选项。对按token付费的企业用户来说,同样的预算能跑出数倍的调用量。
方向三:"决策小模型"成了新品类。有云厂商和搜索公司先后开源了专门回答结构化判断的微型模型:输入一个问题清单,毫秒级返回带置信度的选择结果。它们不写诗不聊天,却恰恰是智能体工作流里用量最大的环节——用小模型干杂活,把贵的大模型留给硬骨头,这套"大小搭配"正在成为省钱的标准架构。
二、开源模型的商业逻辑变了
早年开源模型常被调侃为"技术布道",如今已经是清晰的商业策略:模型开源引流,企业级服务收费;社区验证口碑,托管版本赚钱。对使用者来说,最重要的变化是议价权——当一款MIT协议的模型摆在桌上,任何商业API的报价都不得不掂量掂量。
另一个容易被忽略的价值是数据主权。开源模型可以完全部署在自己的服务器上,数据不出门——这对医疗、法律、金融等敏感行业,比省那点API费重要得多。
三、选型建议:别只看榜单跑分
给正在选型的团队三条实在建议:
- 用自己的真实任务测,别迷信通用榜单——你的场景里"够用"比"顶尖"重要;
- 算总成本:模型本身的调用费只是零头,迁移改造、运维人力、显卡租用都要摊进去;
- 关注许可证细节:同样是开源,商用条款、品牌使用限制各有不同,法务过一遍再上生产环境。
四、普通人现在能做什么
- 开发者和学生:下载一个开源模型在本地跑起来,这个技能的简历含金量正在快速上升;
- 中小企业主:让技术人员评估"开源模型加私有数据"的组合,很多原来不敢上云的数据业务,现在有解了;
- 所有用户:AI工具的价格战还在继续,你订阅的服务大概率会降价或加量,记得主动比价。
开源与闭源的拉锯战打了这么多年,这轮的新变化是:开源阵营不再只是"追赶者",开始在某些场景率先定义玩法。