据雷峰网报道,在2026年云栖大会上,阿里大模型团队披露下一阶段路线:Qwen4系列即将到来,Qwen4.5和Qwen5计划迈向5T至10T参数;下一代视频生成模型将于11月亮相,模型还被用于芯片设计、推理框架适配等研发环节。

云栖大会议程变化明显。吴泳铭发言后,首先登台的是千问大语言模型负责人刘大一恒,随后是负责多模态的ATH技术副总裁郑波,平头哥高慧与阿里云CTO李飞飞接在模型演讲之后。芯片和云仍是阿里底牌,但市场更关心模型往哪走、做多大、能不能打。据雷峰网报道,这些负责人回应了三个问题。

刘大一恒给出的路线图显示,Qwen4系列即将到来,Qwen4.5和Qwen5计划迈向5T至10T参数。2026年8月发布的Qwen3.8参数为2.4T,两年前Qwen2.5旗舰模型参数为72B。阿里判断基础模型智能上限仍离不开算力、数据和模型规模投入,会继续扩大预训练计算量。同时,Qwen3.8-Flash通过稀疏注意力、线性注意力和外接记忆等新架构,每次推理只激活6B参数;训练成本降至九分之一,百万Token输入价格降至四分之一,超长上下文预填充吞吐量提高8.6倍,能力继续上涨。

关于迭代速度,雷峰网提到递归自我改进方向。Anthropic让Claude优化训练小模型代码,去年提速到3倍,今年最新模型做到52倍;OpenAI训练GPT-Red攻击其他模型,GPT-5.6面对最难提示注入攻击时失败率比四个月前低约六倍。阿里让Qwen3.8-Max仅凭一份真实片上网络模块规格,在60多个小时内自主调用EDA工具完成电路描述、验证到物理实现,芯片物理面积减少42%,功耗估算下降59.5%。面对未适配的平头哥新GPU,Qwen3.8-Max自行修改优化SGLang推理框架,用56小时完成部署,日常对话场景单实例吞吐量提高96%。阿里还披露,Qwen3.8-Max曾连续自主运行一个多月,完成33轮有效实验。雷峰网称,模型自主造出下一代模型仍有距离,但模型正更深进入研发环节。

多模态方面,郑波称下一代视频生成模型将在11月亮相,并将下一阶段称为“Agent Video”,由用户给出想法,模型拆解剧情、设计分镜、安排人物和场景,生成完整视频,沿更长、更可控、更完整、更智能推进。图像生成模型Qwen-Image-3.1亮相,面向电商、创意、设计等场景,将原本数小时的视觉设计压缩至秒级交付。语音模型Qwen-Audio-3.1系列升级ASR、TTS和Realtime,已用于千问办公和Qoder,并接入QwenNote A2、QwenNote Eva和千问AI眼镜等硬件。音乐模型HappyShrimp1.1发布,支持百余种曲风与十余种主流语言;世界模型HappyOyster公布2.0 Preview版本,可更准确模拟物体运动和碰撞,通过3D时空记忆保持场景稳定。郑波判断,三年内行业可能出现原生全模态统一生成模型。