从 ERNIE 1.0 到文心 5.0,读懂百度 All in AI 的十年

从 ERNIE 1.0 到文心 5.0,读懂百度 All in AI 的十年

李彦宏可能是中国互联网大佬里最早喊出”All in AI”的人,但这条路他走了十三年。这中间有过明星科学家出走的尴尬,有过被外界嘲讽”起了个大早赶了个晚集”的至暗时刻,也有过 2025 年被 DeepSeek 刺痛后的决绝转身。这篇文章讲清楚百度这盘 AI 棋到底是怎么下的。

1. 押注

2013 年 1 月,李彦宏做了一个在当时看来相当冒险的决定:成立百度深度学习研究院 IDL。那时候深度学习还只是学术界的热门词,工业界几乎没人真金白银往里砸。李彦宏亲自挂名院长,余凯任副院长,他后来解释过为什么,说自己不是真懂深度学习,而是要靠这块牌子把全世界的华人 AI 天才吸引到百度来。2014 年 5 月,他真的把”谷歌大脑之父”吴恩达挖到了北京任首席科学家,整个中国科技圈为之震动。那几年百度在 AI 上的投入近乎奢侈,2016 年推出”百度大脑”,2013 年就启动的自动驾驶项目 2017 年升级为 Apollo 开放平台,李彦宏自己坐着无人车开上北京五环吃了一张罚单,成了当年最出圈的 AI 新闻。

2. 散场

但故事没有按理想剧本走。2017 年 3 月吴恩达宣布离职,明星科学家时代落幕。之后几年百度 AI 更多是在搜索、广告、地图这些老业务里做优化,公众感知并不强。李彦宏没有动摇,他把 AI 的火种留了下来,只是换了一批人来烧。这中间百度默默做了两件影响深远的事:一件是 2016 年开源了深度学习框架飞桨 PaddlePaddle,另一件是 2019 年开始做预训练语言模型。这两件事在当时都不起眼,后来却成了百度大模型时代最厚的两块底。

3. 提前四年

2019 年 3 月,百度发布 ERNIE 1.0,这比 ChatGPT 的发布早了整整三年半。那时候 GPT 还没出圈,大模型在国内更是一个陌生概念,百度就已经把知识图谱和预训练结合起来,做出了中文世界里第一套拿得出手的预训练模型。ERNIE 的思路很有百度特色:它不只从文本里学,还把知识图谱里的实体和关系喂给模型,这就是后来百度一直强调的”知识增强”。2021 年 12 月 ERNIE 3.0 冲到千亿参数,成为当时全球最大的中文单体模型。但这些成绩在当时并没有引起太多关注,因为大模型的风暴还在斯坦福的实验室里酝酿。

4. 仓促应战

2023 年 3 月 16 日,ChatGPT 发布四个月后,百度匆匆召开发布会推出文心一言。这是国内第一个对标 ChatGPT 的大厂产品,李彦宏亲自站台,百度股价当天涨了又跌。但发布会现场演示用的是预录视频,被网友嘲讽是”PPT 发布会”。这背后其实有个无奈:百度的模型当时还没完全准备好直接面向公众。即便如此,8 月 31 日文心一言还是率先通过备案向全社会开放,成了国内第一个合规上线的生成式 AI 产品,两个月用户冲到 4500 万。同年 10 月文心 4.0 发布,李彦宏称其”与 GPT-4 毫不逊色”。

5. 慢下来

那之后百度的节奏突然慢了。2024 年一整年,基座模型只更新了一个更快更便宜的 4.0 Turbo,外界开始质疑百度是不是掉队了。与此同时,字节豆包靠抖音的流量疯狂增长,阿里通义千问靠开源收拢开发者,百度却好像卡在了原地。李彦宏心里清楚问题出在哪:闭源路线下,模型既不像豆包那样有 C 端爆款,又不像 Qwen 那样有开源社区,夹在中间很难受。但百度需要时间想清楚下一步该往哪走。

6. 被刺痛

真正的转折发生在 2025 年初。DeepSeek 横空出世,这家由量化基金幻方孵化出来的公司,用开源模型把整个大模型行业的定价体系冲垮了。百度被深深刺痛。2025 年 2 月,百度内部宣布放弃坚持多年的闭源策略。3 月 16 日文心 4.5 和深度思考模型文心 X1 一起发布,API 价格直接打到 GPT-4.5 的百分之一。三个月后的 6 月 30 日,文心 4.5 系列模型权重在 GitCode 和 Hugging Face 全面开源,免费可商用。这个转身来得又快又决绝,很多老百度人都没想到。

7. 新高峰

开源转身之后,百度的基座迭代反而提速了。2026 年 1 月 22 日文心 5.0 发布,参数规模冲到 2.4 万亿,是原生全模态模型,文本、图像、音频、视频统一在一个模型里训练。5 月文心 5.1 接棒,强化推理和 Agent 能力。从 2019 年那个只有几亿参数的 ERNIE 1.0,到 2026 年这个 2.4 万亿参数的文心 5.0,七年时间模型规模涨了不知多少个数量级。李彦宏当年那句”主菜是人工智能”,到今天才算真正端上桌。

8. 结语

百度的 AI 故事最特别的地方在于,它从来不是靠一个爆款产品赢的。2024 年 9 月文心一言 App 更名”文小言”,重新定位成”新搜索”助手,百度搜索本身也从十条蓝色链接慢慢改成 AI 直接生成答案。底层是飞桨框架和昆仑芯芯片,中间是文心大模型,应用层则同时押了三条线:文小言和新搜索守数字世界的入口,萝卜快跑闯物理世界的无人化,到 2026 年初已经跑出 2000 万单,百度智能云把模型卖给千行百业。这十三年李彦宏赌的不是某一个模型,而是 AI 这件事本身值得 All in。今天回头看,他可能是对的,只是这条路比所有人预想的都要长。