9月3日,两项面向AI生成场景的技术成果同日对外披露。据雷峰网报道,中科通量推出全球首款基于RISC-V数据流架构的视频智能AIGC芯片SmarCo GC3;另据量子位报道,影眸Hyper3D发布世界生成模型WorldGen,将3D生成从单件资产推进到可编辑、可交互的场景级阶段。

SmarCo GC3主打解决视频生成中的“存储墙”难题。据雷峰网报道,在传统冯·诺依曼架构下,视频生成任务中的大量能耗与延迟发生在参数和中间结果于芯片与显存间的搬运上,而非实际计算;视频的时序建模和多帧依赖使数据搬运开销进一步叠加。SmarCo GC3没有程序计数器和乱序执行逻辑,而是让计算节点在所需输入数据齐备时自动触发,生成结果直接流向下一节点,减少片外读写。

具体规格上,SmarCo GC3提供200 TOPS(INT8)AI算力,配备128GB LPDDR5统一内存池和ECC纠错,并集成128路1080P硬解码引擎。中科通量将数据流架构与RISC-V开放生态绑定,用向量扩展和可定制指令将Transformer高频算子固化为专用执行单元,以降低开发者迁移成本。雷峰网在报道中称,数据流架构自上世纪70年代已有学术探索,该芯片能否在实际生产中兑现性能,仍需更多测试验证。

另据量子位报道,影眸Hyper3D发布的WorldGen,用户上传一张场景图后,约2至3分钟即可得到完整3D场景。与传统“一张图片只生成一个模型”的方式不同,WorldGen把场景拆解为多个独立生成的资产,背景用3D Gaussian Splatting补全;每个物体可单独移动、替换,资产间具有物理关系。开启SimReady模式后,系统还会为各资产补充碰撞体并估计质量、摩擦系数等属性,使场景可直接用于仿真。

WorldGen的技术基础是影眸Hyper3D此前获得SIGGRAPH 2025最佳论文的CAST方案。CAST先把输入图片分成对象并估计深度,逐物体生成几何与补全遮挡,再放回统一空间并做物理校正。量子位报道称,团队为将CAST产品化,用近一年时间重构流程,解决多模块串联造成的错误累计,最终形成了WorldGen完全体。

在应用侧,影眸Hyper3D已与地瓜机器人、谋先飞在今年7月联合推出具身智能闭环方案,由WorldGen从真实影像生成可交互三维场景,谋先飞MotrixSim引擎负责物理与并行仿真,地瓜机器人提供算力与工具链。影眸Hyper3D作为NVIDIA Inception成员,也在推动把整个3D场景用于英伟达Isaac Sim仿真。游戏方面,该团队与Unity中国合作,尝试让生成的场景资产直接进入Unity、Blender等引擎进行二次编辑。影视创作中,已有使用者将WorldGen与视频生成模型结合,先以3D场景控制镜头构图,再由视频模型补充人物表演与画面风格。