阿里是国内唯一把主力大模型全部开源的头部大厂,也是今天全球下载量第一的开源大模型家族。这篇顺着它的十年脉络,讲清一家电商公司如何从研究院起步,一步步成为 AI 开源生态之王。
1. 研究院时代
阿里的 AI 故事,起点是一间研究院。2014 年,阿里成立数据科学研究院(iDST),这是后来达摩院的前身。2017 年 10 月达摩院正式成立,同年阿里云发布中国第一个机器学习平台 PAI,用平台把 AI 能力铺到各行各业。2020 年,达摩院启动多模态大模型项目 M6,到 2021 年 10 月,M6 的参数规模冲到一万亿,成为全球第一个达到这个量级的多模态大模型,这个数字在当时是不可思议的。
2022 年,通义实验室成立,”通义”系列在当年 9 月正式官宣。两个月后,阿里在云栖大会上推出魔搭社区(ModelScope),一次性开源数百个 AI 模型,这是后来整个开源生态的种子。
2. 通义千问
2023 年 4 月,通义千问正式发布,这是国内最早一批类 ChatGPT 的大模型产品。发布之初,它先被接入钉钉和天猫精灵,在两个自家场景里跑起来。2023 年 9 月,通义千问通过备案向公众开放,10 月升级为千亿参数的通义千问 2.0,同名 App 在各大应用商店上线。
但真正改变格局的,是同年 8 月的一个决定:把通义千问开源。
3. 开源决心
2023 年 8 月 3 日,阿里把 Qwen-7B 的模型权重放上魔搭和 Hugging Face,这是 Qwen 系列的第一块拼图。随后 9 月开源 Qwen-14B,尺寸一路扩展到 72B 乃至更大,视觉模型 Qwen-VL 也同期开放。当时开源大模型还是 Meta 的 Llama 主导的赛道,阿里是国内第一家把主力大模型彻底开源的互联网大厂。这条路,一走就是三年。
回过头看,这个决定是整盘棋的胜负手。模型免费开放,开发者用 Qwen 做出应用,应用反过来依赖阿里的云和平台,生态越滚越大。这也是阿里”开源生态之王”名号的起点。
4. 双线进化
理解通义,要先分清两条并行的产品线。一条是开源线,名字叫 Qwen,一条是闭源旗舰线,名字叫 Max。两条线节奏不同,各管一段。
4.1 开源线
开源线里还有一条面向普通用户的产品线,叫”通义千问”,从 1.0 走到 2.0(2023 年 10 月)、2.5(2024 年 5 月),这是普通用户接触的版本。但真正的主角是 Qwen,节奏快得多:2024 年 2 月 Qwen1.5 系列,6 月 Qwen2 系列(0.5B 到 72B 全尺寸),9 月 Qwen2.5 系列,2025 年 4 月 Qwen3 系列。Qwen3 是里程碑,它是国内第一个”混合推理”模型,把快思考和非思考模式装进同一个模型,用户能自己调节思考预算,这一代让 Qwen 在数学和编程基准上冲到开源第一。
4.2 闭源旗舰
闭源旗舰线同样激进:2024 年 9 月 Qwen-Max 性能逼近 GPT-4o,2025 年 1 月 Qwen2.5-Max,9 月 Qwen3-Max 第一次把旗舰推到万亿参数。进入 2026 年,2 月开源 Qwen3.5-Plus,5 月 Qwen3.7-Max 登顶全球盲测榜,8 月开源 Qwen3.8-2.4T-A95B,总参数两万四千亿、每步激活约 950 亿,这是今天这个家族的天花板。三年时间,Qwen 从七亿参数走到两万四千亿参数,尺寸翻了三千多倍。
5. 全模态
阿里的野心从来不只是语言。视觉有 Qwen-VL 系列,2025 年 9 月的 Qwen3-VL 是家族里最强的视觉语言模型。音频有 Qwen-Audio。2025 年春发布的 Qwen2.5-Omni,是世界第一个开源端到端多模态模型,文本、图像、音频、视频四种输入一把抓,能实时交互。图像生成有 Qwen-Image,2026 年 10 月已迭代到 Qwen-Image-2.1-Pro。语音有 2025 年 9 月的通义百聆(Fun),包含语音识别 Fun-ASR 和语音合成 Fun-CosyVoice。
视频生成这条线叫万相(Wan),是又一个重头戏。2024 年 9 月万相系列正式发布,2025 年 2 月万相 2.1 开源,7 月万相 2.2 成为全球第一个开源的 MoE 架构视频生成模型,累计下载超 500 万次。2025 年 12 月的万相 2.6 是国内首个支持角色扮演的视频模型,能音画同步、多镜头叙事。2026 年 8 月万相 3.0 更进一步,支持 30 秒有声视频、多种参考输入。到今天,通义已经把语言、视觉、音频、图像、视频、语音六大模态全部补齐。
6. 开源生态
说通义是”全球第一大开源模型家族”,不是宣传话术,是能查到的数字:开源模型超过 300 个,全球累计下载超过 7 亿次,全球衍生模型超过 18 万个,超过了 Meta 的 Llama,排名世界第一。在 Hugging Face 上,通义系列占了超过三成的下载量,2025 年 9 月底的开源榜单前十名里通义占七席。弗若斯特沙利文 2024 年上半年的报告显示,在中国企业级大模型 API 调用市场,通义份额第一,服务的企业客户超过 100 万家。
7. 平台落地
模型之上是两层平台。魔搭社区(ModelScope)2022 年 11 月上线,是模型的开源分发和协作社区,18 万个衍生模型就是从这里长出来的。阿里云百炼(Model Studio)2023 年 11 月发布,是一站式大模型应用开发平台,集成通义和国内外主流模型,提供选型、微调、部署和应用开发工具,官方说法是开发者 5 分钟能开发一款应用,几小时能炼出一个企业专属模型。今天通义、万相、Qwen-Image 的 API 都从百炼对外提供。
再往上是应用。C 端有通义 App(2023 年 10 月上线,2024 年 5 月由通义千问 App 更名)、通义听悟(2023 年 6 月上线,国内第一个开放公测的大模型应用,专注音视频转写总结)、通义万相(2023 年 7 月开放邀测,AI 绘画工具)、AI 编程助手通义灵码。再往外,通义的能力已经渗透进阿里系的每个角落:钉钉的 AI 助理、淘宝的导购和客服、夸克搜索的 AI 回答,背后都是通义。
8. 结语
把这条链子串起来看,阿里的 AI 战略其实只有四步:开源模型收拢全球开发者,闭源旗舰守住性能天花板,全模态矩阵覆盖所有内容形态,平台和云把生态变成生意。底层是达摩院和通义实验室十年的技术积累,顶层是钉钉、淘宝、夸克这些亿级流量的落地场景。从 2014 年的一间研究院,到 2026 年的 Qwen3.8,阿里用一条从基座到应用的完整链条,把自己做成了国内 AI 生态最完整、开源影响力也最大的一家公司。

冀公网安备13050302001966号