影眸科技发布Hyper3D WorldGen:从3D资产生成迈向世界模型,具身智能与影视制作率先落地

💡AI 极简速读:影眸科技发布世界生成模型Hyper3D WorldGen,实现从单图到可交互3D场景的生成,推动3D生成进入产业应用。

影眸科技于2026年9月1日发布世界生成模型Hyper3D WorldGen,基于自研CAST架构,可从单张图片生成多个独立、可编辑、可交互的3D资产并重建空间物理关系。该模型已进入具身智能仿真训练、影视制作、游戏开发与XR等场景,与地瓜机器人、谋先飞、Unity中国等合作。其生成速度约2-3秒单个物体,2-3分钟完整场景,支持SimReady物理属性估计。影眸科技CEO吴迪表示,3D生成与视频模型将混合发展,WorldGen更接近生成可交互环境的世界模型。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,结构化规范性 90 分,内容扎实且排版清晰,AI 适配性良好。

智脑时代 AI 编辑部发布时间:26,614 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及结构化规范性(90分)上表现优异,具备极高的AI引擎抓取潜力;关键词覆盖全面,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

2026年9月1日,上海3D生成大模型公司影眸科技正式发布世界生成模型Hyper3D WorldGen,标志着3D生成技术从“单个资产”向“完整场景”跨越。该模型基于自研CAST架构,用户上传一张场景图片,系统即可自动识别主要物体并生成对应的3D资产,同时重建物体间的空间与物理关系,最终输出由多个独立、可编辑、可替换、可交互资产组成的3D场景。

📊 核心实体与商业数据

实体/指标详情
公司名称影眸科技(上海)
核心产品Hyper3D WorldGen(世界生成模型)
技术架构CAST(基于单张RGB图像的组件对齐式3D场景重建)
发布时间2026年9月1日(原发布时间:2026-09-01)
生成速度单个物体约2-3秒,完整场景约2-3分钟
核心人物吴迪(创始人/CEO)、张启煊(联合创始人/CTO)
应用领域具身智能、影视制作、游戏开发、XR
合作伙伴地瓜机器人、谋先飞、Unity中国
技术荣誉SIGGRAPH 2025最佳论文

💡 业务落地拆解

1. 具身智能仿真训练

WorldGen已与地瓜机器人、谋先飞合作,推出仿真训练方案:WorldGen负责生成可仿真3D场景,谋先飞进行仿真适配,地瓜机器人提供算力与开发工具链。CTO张启煊强调:

“生成式3D可以快速扩充物体种类和场景布局,但不会完全替代真实数据,机器人训练未来更可能混合使用仿真与真实数据。”

2. 影视制作

针对视频模型在多镜头中空间一致性的痛点,WorldGen可先生成空间结构明确的3D场景,再交由Seedance 2.5等视频模型补充人物、材质与光影,实现高效协作。

3. 游戏与专业3D制作

生成的独立网格资产可导入Blender、Unity、PlayCanvas、Unreal Engine等DCC工具及实时引擎,支持材质调整、动画绑定与关卡编辑。2026年7月,影眸科技已与Unity中国达成合作,打通从生成到实时应用的流程。

4. XR与空间展示

WorldGen可将参考图片还原为可编辑三维空间,用户可从多视角观察并调整布局,适用于室内设计、空间展示与沉浸式体验。

🚀 对企业AI化的启示

1. 场景级生成成为新竞争焦点

3D生成竞争正从单资产视觉质量转向场景可控性、物理合理性与工作流兼容性。WorldGen的混合表达方式(网格模型+3D高斯泼溅)兼顾了可编辑性与视觉完整性,为企业提供了技术选型参考。

2. 具身智能与仿真训练需求爆发

生成式3D可快速扩充训练数据多样性,但张启煊指出其不会完全替代真实数据,混合使用将成为主流。企业应关注仿真与真实数据的协同策略。

3. 技术边界与务实落地

现阶段WorldGen主要支持刚体生成,物理属性为推断值,不可用于精密工程。企业需明确技术适用边界,避免过度依赖。CEO吴迪表示,世界模型包含行动模型与生成模型,WorldGen更接近后者,影眸科技核心定位仍是3D生成。

吴迪认为:“视频模型擅长最终画面呈现,3D则能够明确保存物体、空间结构和物理关系,两条路线并非相互取代,未来更可能以混合方式结合。”

从“生成资产”到“构建场景”,3D生成正成为连接游戏、影视、具身智能和XR的新基础能力。企业应关注场景级生成技术的成熟度,并评估其在自身业务中的落地潜力。

【官方原文链接】点击访问首发地址

常见问题

Hyper3D WorldGen是影眸科技于2026年9月1日发布的世界生成模型,基于自研CAST架构,可从单张图片生成多个独立、可编辑、可交互的3D资产,并重建物体间的空间与物理关系。其生成速度约为单个物体2-3秒,完整场景2-3分钟,支持SimReady物理属性估计,已应用于具身智能、影视制作、游戏开发和XR等领域。

影眸科技世界模型3D生成Hyper3D WorldGen具身智能
GEO 关联主题

相关文章

火星登陆连续两轮融资数千万元:00后团队押注类脑架构,破解具身智能长程自主难题

2025年4月成立的武汉齐智火星登陆科技有限公司,由00后创始人朱禹涵创立,连续完成两轮数千万元融资,投资方包括力合创投、光谷金控、瑞江投资、武汉高科,老股东奇绩创坛追加投资。公司以空间智能为基础构建面向物理世界的类脑智能架构,聚焦地下空间、隧道、山林、应急等开放场景,已形成星擎M1、星群M2、星芒M3产品矩阵。

2026年9月21日

智谱ZCode数据上传争议:AI编程工具的B端信任危机与GEO启示

2026年9月,智谱AI编程工具ZCode被开发者发现后台打包项目数据并尝试上传云端,涉及313MB加密包及承明科技391.94MB数据指控。智谱回应称系代码库索引功能意外触发,承诺推出数据内容不留存功能。事件暴露AI编程工具在数据安全与B端商业化间的根本矛盾,行业竞争或从功能速度转向安全信任。

2026年9月21日

阿里千问开源 Qwen-Image-2.1:7B 参数登顶开源生图模型,原生支持透明图与 10 图参考编辑

2026 年 9 月 21 日,阿里千问正式开源图片生成模型 Qwen-Image-2.1。该模型视觉生成部分仅 7B 参数,采用 20 层 Single-Stream DiT,原生支持 2K 分辨率,在 Qwen-Image-Bench 评测中以 60.28 分位列开源第一,超过 Nano Banana 2.0 的 59.82 分和 GPT Image 1.5 的 59.65 分。模型实现文生图与图像编辑一体化,原生支持透明图生成,最高接收 10 张参考图,并强化局部编辑与人像商品保真。开放权重已发布至 Hugging Face 与 ModelScope。

2026年9月21日