商汤 2014 年由香港中文大学教授汤晓鸥创立,是业内常说的 AI 四小龙之一,靠人脸识别起家。这篇文章讲这家学术派出身的公司,如何从实验室理想出发,在视觉见顶后果断转舵,做成今天的全栈多模态大模型厂商。
1. 实验室
商汤的起点是香港中文大学的一间实验室。创始人汤晓鸥是港中文教授、国内深度学习领域的旗帜性学者,2014 年 10 月带着学生们出来创业,初衷很学院派,就是想把实验室里的算法变成能用的产品。赶上智能手机和安防的大潮,商汤靠人脸识别和计算机视觉迅速崛起,客户覆盖手机、安防、自动驾驶和城市治理,和旷视、依图、云从并称 AI 四小龙,还连续多年坐上中国计算机视觉市场份额的头把交椅。2021 年公司登陆港交所,一度是资本市场最炙手可热的 AI 明星。汤晓鸥身上那股做学问的较真劲,也悄悄写进了这家公司的基因里。
2. 大装置
和那些轻装快跑的同行不同,汤晓鸥做了一个重到吓人的决定,自建 AI 基础设施。公司砸重金打造 SenseCore 商汤大装置,把算力、算法和平台全部打通,又通过商汤方舟把视觉能力工程化输出给城市。在当时这被质疑太烧钱,但正是这套峰值算力达到万卡级别的大装置,后来让商汤能同时训练几十个大模型,在转身时比别人都快。
3. 转舵
2023 年,ChatGPT 让整个行业的风向一夜改变,靠卖视觉项目增长的商汤遇到了瓶颈,毛利见顶、估值承压。它敏锐地意识到,生成式 AI 才是下一站,于是果断把公司的重心往大模型上挪。2023 年 4 月,它几乎和国内大厂同步发布日日新 SenseNova 大模型体系,其中商量 SenseChat 1.0 是国内最早的千亿参数聊天机器人之一。同年 6 月,商汤又联合上海 AI 实验室等科研力量,发布了参数量 1040 亿的基模型 InternLM。从视觉到生成式,这家学术派出身的公司转身转得又快又稳。
4. 多模态
转舵之后,商汤把多年的视觉积累化成了多模态优势。2024 年 4 月,日日新 5.0 发布,全面对标 GPT-4,还一次性推出从云端到边缘的全栈产品矩阵。同年 7 月的世界人工智能大会上,商汤又发布了国内首个流式原生多模态交互大模型。2025 年 4 月,日日新 V6 问世,这是国内第一个把语言和视觉原生融合在一起的通用大模型,不是简单拼接,而是从底层一起训练。7 月再发 V6.5,性价比提升三倍,当年底还拿下中文多模态评测的国内第一。围绕多模态,商汤还推出了数字人如影 SenseAvatar 和商量拟人等产品,把生成的能力直接做成能看见、能互动的形象。多年练出的视觉功夫,在这一代模型里彻底接上了力。
5. 开源
2025 年底到 2026 年,商汤接连打出开源牌。2025 年 11 月发布并开源空间智能模型 SenseNova-SI,能把卫星影像和规划图纸融合理解。2026 年 4 月 29 日,它发布并开源旗舰 SenseNova U1 系列,采用原生理解生成统一架构,把理解和生成放进同一个模型。5 月 8 日再推轻量化的 6.7 Flash-Lite,Token 消耗直降六成,还把全套办公技能放到 GitHub 上开放。和创业公司只放单个模型不同,商汤习惯把模型、技能、工具链成套开放,慢慢聚起自己的开发者生态。这种先重投入建平台、再让应用长出来的打法,和它当年做视觉时一脉相承。
6. 结语
商汤的故事,是一家学术派公司的两次转身。第一次是从港中文的实验室走进产业,做成了视觉 AI 的龙头。第二次是在视觉增长见顶时,押注大装置和多模态,把自己重新做成了生成式 AI 的玩家,2025 年公司收入重回增长、突破 50 亿元。从 2014 年做人脸识别,到 2026 年开源原生统一架构的 U1,商汤走过的这条路并不轻松,中间经历过上市后的估值低谷和战略阵痛,但它毕竟走通了。汤晓鸥当年那个把算法变成产品的理想,换了一种方式延续了下去。

冀公网安备13050302001966号