9月22日,千问办公在云栖大会发布面向企业级Agent的基础设施“企业上下文”(Enterprise Context)和硬件QwenNote A2,阿里云同日更新全模态模型矩阵。同一天,英特尔在苏州技术创新与产业生态大会上提出,Agent正在改变AI计算配比,CPU与GPU比例从1:4趋向1:1,CPU价值需要重新衡量。
据雷峰网报道,Enterprise Context把群聊、文档、知识库和业务系统里的信息压缩、结构化并持续更新,让Agent按任务调用最相关部分,用内置专属模型压低Token成本。QwenNote A2由钉钉2025年录音卡A1升级,配6个麦克风,最远8米拾音,转写准确率98%,内置4G物联网卡。长按AI键可语音给千问办公派活,转写内容只保留文字和纪要,不留原始音频。千问办公CEO陈宇森称,一家中大型企业内部注册数据规模约150PB,当前最强上下文窗口只有百万Token级。其路径是连接、理解、复用,权限继承企业在IM中的组织、身份和权限体系。古茗茶饮把运营文档打包成“门店运营知识空间”,服务近万名一线员工,不同岗位有不同权限。
据量子位报道,阿里云在云栖大会更新模型矩阵:Qwen3.8-Max开始自己训练自己,Qwen3.8-Flash提前放出下一代架构,Qwen3.8-Omni为大模型开辟思考分区,Qwen4已开练,Qwen4.5、Qwen5在路上,参数规模瞄准5万亿至10万亿。图像、音乐、世界、语音、同传模型均有更新,下一代视频模型预告11月发布。
导演陆川团队用AI在5天重建400年前明代灾难现场。据量子位报道,传统影视工业做类似复原往往需数月和千万级投入,过去一场爆炸戏要19天。团队做约四轮提示词优化,参考真实爆炸影像校准,阿里视频模型对烟尘、碎片还原准确度达预期的95%以上,视频生成环节贡献超过一半。演员王珞丹说,她曾抽卡到凌晨4点,早上6点才抽到想要的镜头。Wan3.0支持单次30秒生成,能接受文档、表格、网页等结构化输入,曾在Artificial Analysis文生视频和视频编辑两项榜单位列第一。太合音乐集团总裁余灏称,AI降低音乐创作成本,但版权和AI翻唱授权绕不过。阿里巴巴ATH事业群副总裁郑波说,三年内会出现原生全模态统一生成模型,下一代视频模型11月发布,方向之一是从生成单个镜头走向理解完整叙事。
据量子位报道,英特尔数据中心事业部副总裁陈葆立用“每天早上整理AI新闻”举例:Agent要上网找资料,处理网页、PDF或视频,再交给大模型分析,一次模型调用往往不够,还要拆解任务、调用工具、根据结果决定下一步。中国工程院外籍院士张亚勤称,Agent能围绕目标规划、行动、试错和迭代。陈葆立把数据中心分为CPU服务器或集群、GPU等加速计算资源和存储系统三部分,CPU贯穿执行、编排、预处理和调度。企业采购既关心能运行多少智能体,也关心每个智能体的能力和可靠性。英特尔介绍KV Cache优化,利用处理器内置能力无损压缩、加快数据传输,并与国内软件合作伙伴打造高性能存储系统。英特尔CEO陈立武在视频致辞中称,x86持续驱动计算向智能化应用发展。