据MarkTechPost报道,阿里巴巴云2023年4月7日开始向企业客户发放通义千问邀请码,三年半后,其Qwen系列后代模型以开放权重发布,参数量达到2.4万亿。该报道按发布时间梳理了Qwen从7B到2.4T的路径。
2023年4月11日,时任阿里巴巴CEO张勇在北京举行的阿里云峰会上公开展示通义千问。该名称部分取自孟子,阿里巴巴当时表示将把模型嵌入各项业务,先从钉钉和天猫精灵开始。2023年8月3日,阿里开源Qwen-7B和Qwen-7B-Chat,直接回应Meta的Llama 2。Qwen-7B预训练使用超过2.2万亿个token,上下文长度为2048个token,其许可证对月活低于1亿用户的商业使用免费。2023年8月底,首个视觉语言分支Qwen-VL发布;9月13日,通义千问向公众开放,同月团队在arXiv发布Qwen技术报告。2023年12月1日前后,阿里发布72B和1.8B模型供下载,Qwen覆盖了从笔记本电脑级到前沿级的开放权重。
2024年,Qwen成为开发者的常见选择,团队在8个月内发布3代模型。2024年2月5日发布的Qwen1.5被定位为Qwen2的测试版,覆盖0.5B到72B稠密模型,各尺寸均支持32K上下文,并推出14B MoE模型,激活参数2.7B,以及家族首个超过100B的110B稠密模型。2024年6月初,Qwen2以0.5B到72B共5个尺寸发布,其中Qwen2-57B-A14B是首个开放MoE旗舰,训练数据在英文和中文之外增加27种语言,7B和72B指令模型支持128K token,除72B外全部转为Apache 2.0许可。当年夏季,Qwen2-Math、Qwen2-Audio相继推出,8月底Qwen2-VL可分析超过20分钟的视频。2024年9月19日云栖大会上,阿里一次性发布超过100个开源模型,Qwen2.5技术报告称预训练数据从7万亿增至18万亿token,尺寸覆盖0.5B到72B,支持128K上下文和8K token生成。阿里巴巴表示,Qwen模型下载量超过4000万次,在Hugging Face上催生超过5万个衍生模型。2024年11月11日,Qwen2.5-Coder全家族发布;11月底,Apache 2.0许可的QwQ-32B-Preview作为OpenAI o1的开放挑战者出现;12月24日,实验性视觉推理模型QVQ-72B-Preview收尾。
2025年1月,DeepSeek-R1成为焦点,Qwen在数周内作出回应。1月26日,Qwen2.5-VL以3B、7B和72B三个尺寸发布,TechCrunch称其可控制PC和手机。1月29日农历新年第一天,阿里推出大规模MoE模型Qwen2.5-Max,据路透社报道,阿里巴巴称其性能超过DeepSeek-V3。3月6日,基于Qwen2.5-32B并用强化学习训练的QwQ-32B以Apache 2.0发布,Qwen称其性能可与671B的DeepSeek-R1相比,VentureBeat指出两者硬件差距约为24GB显存对超过1500GB显存,当天阿里巴巴港股上涨超过7%。3月26日,Apache 2.0许可的Qwen2.5-Omni-7B发布,可接收文本、图像、音频和视频输入,并以文本或语音作答,CNBC称其面向高性价比AI智能体。
2025年4月29日,Qwen3发布,包括6个0.6B到32B的稠密模型和2个MoE模型,旗舰为激活参数22B的Qwen3-235B-A22B,全部以Apache 2.0发布。其关键功能是混合思考,同一模型可由用户切换逐步推理或即时回答。Qwen3技术报告列出预训练约36万亿token,语言覆盖从29种增至119种语言和方言,TechCrunch称其为混合推理模型家族。2025年7月21日,Qwen将混合思考拆分,Qwen3-235B-A22B-Instruct-2507作为非思考模型发布,原生上下文为262K,随后又推出独立的Thinking-2507检查点。