你有没有发现,那个曾经把大模型"关着卖会员"的百度,现在画风全变了?
一边是文心一言从2025年4月起全面免费,一边是百度把上一代旗舰ERNIE 4.5直接开源。到了2026年1月,文心5.0正式版把参数堆到了2.4万亿。动作一个接一个,看得人有点跟不上节奏。这背后,其实是百度对"大模型该怎么赚钱、怎么活下去"的一次重新下注。
一、2.4万亿参数的"原生全模态"
2026年1月22日,百度发布并上线文心大模型5.0正式版。它最突出的两个标签是:参数达2.4万亿,以及"原生全模态"——不是把文本、图像、音频、视频几个模型拼起来,而是在同一个自回归架构里联合训练。
为了让这个庞然大物跑得起,文心5.0用了超大规模混合专家(MoE)结构,激活参数比例低于3%。也就是说,模型很大,但每次推理只唤醒其中一小部分,推理成本因此可控。
往前看一步:2025年11月的百度世界大会上,文心5.0已经先放了Preview版;而真正让外界意外的,是百度在开源上的转向。
二、从"闭源"到"开源"的急转弯
时间回到2025年2月,李彦宏公开表示要把大模型开源,理由是"让技术扩散得更快"。随后在2025年6月,百度开源了ERNIE 4.5系列,采用Apache 2.0协议,包含规模达4240亿参数的MoE变体,可免费商用。
这在百度历史上是少见的战略反转。过去李彦宏更倾向把旗舰模型攥在手里,但在DeepSeek、Qwen等一众开源模型把"免费"做成行业标配之后,闭源的护城河显然没那么牢了。
到了2026年5月9日,百度又上线了文心5.1,主打"多维弹性预训练",宣称预训练成本约为同规模模型的6%——不再一味堆参数,而是想办法把训练账单压下来。
三、百度真正的筹码在"落地"
相比参数和榜单,百度更想讲的故事是应用。千帆大模型平台累计开发的智能体(Agent)已超过130万个,文心一言月活跃用户突破2亿。百度把模型拆成了"矩阵模型"和"专精模型"两层:前者服务通用场景,后者扎进搜索、电商、数字人这些具体生意。
典型例子是实时交互数字人——基于声音Token的三态联动架构,已经用在"百度罗永浩数字人"这类直播场景里。对百度来说,模型本身不是终点,能嵌进搜索、云、营销的闭环里才算赢。
普通人现在能做什么
第一,如果你做内容或带货,去试试百度文心一言和数字人工具。开源+免费的路线意味着接入成本很低,尤其数字人直播这类功能,小团队也能低成本试水。
第二,如果你是企业IT负责人,把千帆平台的Agent开发能力当作低代码工具箱看待。130万个Agent已经跑出来的生态,说明有大量现成模板可抄,比从零搭省事得多。
第三,如果你是开发者,ERNIE 4.5已经开源可商用,正好拿来和DeepSeek、Qwen做横向对比。在多家都免费的前提下,多测几家、用脚投票,才是普通人的最大红利。