9月8日至9日,多个人工智能团队密集发布新成果。在计算机视觉会议ECCV 2026上,清华、腾讯混元、南洋理工、北航、极佳视界、群核科技等机构分别围绕空间智能与具身智能发表论文;万勋科技同一天发布柔性具身大脑,医疗AI胃癌预测研究也被肿瘤学期刊接收,清华大学教育Agent在联合国教科文组织完成公开演示。
据雷峰网报道,清华、腾讯混元和南洋理工大学提出Spatial-TTT,通过测试时训练将模型中的部分参数变为能在推理中更新的“快权重”,以线性计算开销处理持续视频流,为2B参数模型装上“流式空间记忆”。论文称,该方法在空间基准上超过GPT-5。团队采用3:1混合架构,每四层保留一层全注意力以保证语义推理,并在TTT分支引入3D卷积注入局部几何信息。
据雷峰网报道,来自北航、北大、智源和中科院自动化所等机构的团队提出RoboTracer,用“图像坐标+度量深度”(u,v,d)表示3D轨迹,使同一个模型可以接入不同机器人本体。团队同时构建了约450万样本、3000万问答对的TraceSpatial数据集,数据来自2D图片、3D扫描和真实操作视频三条流水线。在TraceSpatial-Bench上,融合深度与内参后综合成功率由约39%升至45%。
极佳视界和群核科技各有系列论文入选ECCV 2026。据雷峰网报道,极佳视界联合清华、中科院自动化所、上海交大等发表7篇论文,涉及VLA-R1具身操控框架、OmniNWM驾驶世界模型等;群核科技与英伟达、英特尔、浙江大学等发表的3篇论文,分别提出高保真仿真器SPEAR、数据自进化框架Syn-GRPO和交互式空间智能评测基准WalkerBench,尝试为物理AI解决训练环境、数据和评测问题。
据雷峰网报道,万勋科技发布了NOVA2.0柔性具身大脑,并在发布中称其为“行业首个开放世界全天候商业交付级具身智能架构”。该架构可适配机械臂、人形机器人等多种构型,已在40余个行业场景完成超1000万次作业,覆盖从零光照到强日照、零下40摄氏度到60摄氏度的环境。
据雷峰网报道,在医疗方向,河北医科大学第四医院与蚂蚁阿福团队利用常规增强CT和临床资料训练DeepComp模型,在术前同时预测胃癌患者的中重度并发症概率和长期生存风险。该研究已被期刊Annals of Oncology接收,此前同一团队预测胃癌早期复发和术后肝转移的两项研究已发表于Nature Communications。DeepComp研究纳入11家医疗中心的5237例患者,内部验证AUC为0.888,9个外部队列AUC为0.824至0.869。10位外科医生在模型辅助下识别高风险患者的平均敏感性从47.1%升至87.9%。
据爱范儿报道,清华大学教育学院张羽、于济凡9月8日在巴黎联合国教科文组织总部演示了教育Agent OpenMAIC。这是首个登上联合国舞台的中国教育Agent团队。该平台由清华团队2024年启动,2026年3月开源,8月28日发布v1.0专业工作台,截至8月20日已有超过55万名创作者、累计交互超3400万次,覆盖154个国家和地区。v1.0中一个完整创作任务平均消耗约362.5万Token、调用模型74.3次,约为旧版生成一个互动课堂的10.1倍。