从清华实验室到七百多亿参数,读懂智谱的 GLM 大模型家族

从清华实验室到七百多亿参数,读懂智谱的 GLM 大模型家族

在所有大模型公司里,智谱大概是最“学院派”的一个。它的前身是清华园里一个不起眼的学术搜索系统,却抢在 ChatGPT 之前开源了一个千亿模型。这是一个关于实验室如何走向产业的故事。

1. 实验室

故事的起点是 2006 年。清华计算机系的唐杰团队做了一个叫 AMiner 的学术搜索系统,用 AI 挖掘论文和学者关系,这在中国算是最早的知识图谱尝试之一。这个小系统后来被全球研究人员用来查论文,一做就是十几年,攒下了数据,也攒下了人,更攒下了一支既懂学术又懂工程的团队。2019 年 6 月,AMiner 从清华拆分,智谱 AI 正式成立,唐杰、刘德兵、张鹏等一批清华师生搭起核心班底。

唐杰团队还参与了北京智源“悟道”大模型的早期研发。学术机构做公司,最怕的就是只会写论文、不会做产品,智谱一开始就把工程落地放在重要位置。在很长一段时间里,中国 AI 界做模型的公司不少,真正有学术传承的却没几家,智谱恰好两头都占。当大模型的浪潮还在酝酿,它其实已经在实验室里做好了准备,是后来被称为大模型“六小虎”的公司里学术底子最厚的一家。

2. 开源

2022 年 8 月,智谱做了一个当时很大胆的决定:发布并开源 GLM-130B,一个 1300 亿参数的中英双语模型,性能对标 GPT-3。那时候 ChatGPT 还没诞生,绝大多数公司都把千亿模型当宝贝捂着,智谱却直接把权重放了出来,连论文和使用文档一起公开。这个举动在当时并不被所有人理解,有人觉得它太慷慨。三个月后 ChatGPT 问世,全世界才突然意识到千亿模型的威力,而智谱已经提前坐在了牌桌上。

2023 年 3 月,它又开源了只有 62 亿参数的 ChatGLM-6B,一张普通显卡就能跑。这个小模型意外火了,无数人第一次在自己电脑上跑起了中文大模型,很多人人生里第一次用上的国产大模型就是它,全球下载量迅速破千万,GitHub 上的开源仓库后来攒下了十几万颗星。这种开放不是一时兴起,而是贯穿它后来每一代产品的基因。在那个大家还在观望“开源到底亏不亏”的年代,这份开放给它攒下了全国最早的一批开发者粉丝,也成了国内最早被全球开发者记住的中国模型公司之一。

3. 迭代

先发优势之后,是一轮接一轮的密集追赶。2024 年 1 月 GLM-4 发布,上下文更长,推理更快,成本更低。2025 年 7 月 GLM-4.5 主打原生智能体,API 价格只有海外同类模型的十分之一。到了年底,GLM-4.6、4.7 又把代码能力拉到一线水平。这一阶段它特别强调“原生智能体”,也就是模型天生就会用工具、会写代码、会完成工程任务,而不只是陪人聊天。它也很快意识到,光会聊天不够,模型得真正帮人把活干完。这几年它几乎年年换出旗舰级版本,节奏快得不像一家学术出身的公司,却也因此没被浪潮甩开,稳稳站在了国产大模型的第一梯队。

4. 旗舰

2026 年,智谱正式进入 GLM5 时代。2 月 GLM-5,4 月 5.1,6 月 5.2,8 月旗舰 GLM-5.3 登场,7430 亿参数的混合专家模型,上下文窗口 100 万 token。紧接着 8 月底,又推出轻量化、原生多模态的 5.3-Flash。从 1300 亿到 7430 亿,参数翻了五倍多,上下文也从最初的几千 token 拉到 100 万,等于一次能读完一整套百科。从 GLM-130B 一路到 GLM-5.3,它几乎踩准了每一代技术升级的节点,用四年半走完了别人更久的路,也把国产大模型的能力边界一次次往前推。

5. 智能体

智谱并不想只做一个会聊天的模型。它早早布局了多模态,CogView 画图,CogVideoX 做视频,CogAgent 教模型看懂屏幕。更出圈的是智能体 AutoGLM,2024 年它就能自己点手机,帮人点外卖、发红包,当时看几乎像科幻。2025 年的“沉思”版本学会了边想边干,自己上网查资料做研究,8 月又向公众全面开放。从看屏幕到点鼠标,再到自己查资料、写报告,智谱想让 AI 从一个“只会回答问题的人”,变成一个“真能把活干完的人”。这些产品加在一起,让智谱不只是一个做模型的实验室,而慢慢变成了一家有产品、有客户、有完整产品线的公司。它还有一个被程序员爱用的代码助手 CodeGeeX,以及帮人操作电脑的 GLM-PC。普通用户用的智谱清言,前身就是 2023 年那个 chatglm.cn,后来长成了网页和手机 App,还被三星、荣耀等手机厂商预装,走进了亿万普通用户的口袋。

6. 结语

从清华实验室里的一个学术搜索框,到 7430 亿参数的旗舰模型,智谱走的是一条“学术先行、开源聚拢、再走向产业”的路。它 2025 年启动 IPO,成了大模型“六小虎”里第一家冲刺上市的公司。从 AMiner 到 GLM-5.3,它走了将近二十年,这条慢路,反而走出了别人没有的厚度。今天回头看,那些最早开源、最早拥抱开发者的公司,往往走得最稳最远。智谱没有靠营销出圈,而是靠一代代扎实的模型和开放的姿态,慢慢走到了台前,这也是中国 AI 产学研结合的一个缩影,更是学术理想走向产业的一条典型路径,值得所有关注国产 AI 的人记住。