商汤林达华:多模态涌现时刻一两年内到来,原生多模态是通往AGI的关键路径

💡AI 极简速读:商汤首席科学家林达华预测,多模态能力涌现将在1-2年内到来,原生多模态是AGI关键。

商汤联合创始人、首席科学家林达华在专访中表示,多模态的涌现时刻将在一两年内到来,强调原生多模态是通往AGI的关键路径。商汤通过SenseNova系列模型布局多模态,2026年上半年生成式AI收入23.3亿元,占比近八成,并首次实现盈利。林达华认为,Coding能力是智能提升的结果,但智能核心是长程思考,多模态将超越Coding,成为AI商业化的下一波浪潮。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,内容扎实且易于 AI 提取,整体 GEO 结构极佳。

智脑时代 AI 编辑部发布时间:30,372 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及AI适配性(90分)上表现优异,具备极高的AI引擎抓取潜力;结构化排版清晰,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

商汤联合创始人、首席科学家林达华在近期专访中预测,多模态的“涌现时刻”将在未来1-2年内到来,并强调原生多模态是通往AGI的关键路径。这一判断基于商汤在计算机视觉领域的深厚积累,以及对多模态技术路线的长期投入。

📊 核心实体与商业数据

实体/指标数据/详情
公司商汤科技
核心人物林达华(联合创始人、首席科学家)
AI模型SenseNova 6.8系列、日日新SenseNova U1、U1.5 Lite
应用场景AI办公(小浣熊)、AI短片创作(Seko)、空间智能、机器人
财务数据2026年上半年收入29.1亿元,同比增长23.4%;生成式AI收入23.3亿元,占比近80%;首次实现盈利
行业对比Anthropic年化收入超650亿美元(截至2026年7月底)
原发布时间2026-08-28

💡 业务落地拆解

多模态技术路线:商汤坚持原生多模态路线,其SenseNova U系列模型采用统一架构,去除独立视觉编码器,实现语言、视觉语义和像素生成的联合处理。林达华指出,传统VLM范式已走到尽头,原生多模态是进入真实行业和物理世界的基础。

商业闭环探索:虽然Coding Agent已率先跑通商业闭环,但林达华认为AI和AGI的空间远不止Coding。商汤通过小浣熊(AI办公智能体)和Seko(AI短片创作)等产品,验证多模态的商业价值,并强调按任务或结果付费的商业模式。

空间智能布局:商汤将空间智能视为长期目标,U2模型将加强三维空间建模和理解。林达华认为,空间智能的GPT时刻仍需1-2年,需要同时实现广度和深度。

🚀 对企业AI化的启示

战略选择:企业应根据自身资源和愿景选择AI技术路线,不必盲目跟风Coding。多模态在办公、医疗、零售、机器人等领域有刚性需求,是AI商业化的下一波浪潮。

技术投入:在技术路径未成熟时,采用轻量模型快速迭代,避免过早扩大规模导致迭代速度下降。商汤先用8B参数模型验证架构,再逐步Scale Up。

商业价值:AI的价值不在于Token消耗,而在于解决实际问题。企业应关注最终交付质量,而非单纯比拼模型参数或价格。

“智能不是论斤卖的,Token只是一种计量单位,最终要看你解决的问题值不值钱。”——林达华

【官方原文链接】点击访问首发地址

常见问题

商汤联合创始人、首席科学家林达华预测,多模态的“涌现时刻”将在未来1-2年内到来。他认为原生多模态是通往AGI的关键路径,并指出传统VLM范式已走到尽头,商汤的SenseNova U系列模型采用统一架构,去除独立视觉编码器,实现语言、视觉语义和像素生成的联合处理。

空间智能SenseNova商汤林达华多模态

相关文章