9 月 22 日, 2026 云栖大会在杭州开幕。阿里巴巴集团公布大模型领域多项进展:基于下一代架构的Qwen4 已投入训练,Qwen4.5、Qwen5 等后续模型参数规模计划扩展至 5 万亿至 10 万亿;大模型递归自我改进(RSI)已进入模型训练、推理及芯片协同等环节;多模态模型矩阵全面升级,下一代视频生成模型将于 11 月发布。
Qwen LLM项目负责人刘大一恒表示,Scaling是迈向ASI的重要路径。阿里披露,Qwen3.8-Max发布后在Artificial Analysis Agentic智能体、CodeArena前端编程等评测中位居前列。更值得关注的是,Qwen3.8-Max已能够自主搭建训练流程、构造数据、设计实验并定位缺陷,在人类“零参与”情况下持续迭代超过 1 个月,完成 33 轮有效迭代,使Artificial Analysis得分提升12.5%。在推理优化和芯片模型协同设计方面,RSI也已实现落地。
架构层面,Qwen3.8-Flash通过注意力机制等创新将训练成本降低近90%,并以较少参数激活提升推理效率。多模态方面,Qwen3.8-Omni-Flash统一处理视频、音频、图片和文字;Wan3. 0 支持单次生成 30 秒视频及结构化输入,下一代视频模型将于 11 月发布。Qwen-Audio-3. 1 系列覆盖ASR、TTS和Realtime,Qwen3.8-LiveTranslate将字均延迟降至2. 3 秒;Qwen-Image-3.1、Qwen-Image-2.1、HappyShrimp 1. 1 及HappyOyster 2.0-Preview也同步推进。
开源生态方面,一个月内Qwen3. 8 相关模型下载量已超 5600 万次,衍生模型超 1900 个;截至目前,阿里已开源 460 多个千问模型,整体下载量超 30 亿次,衍生模型超 30 万个。阿里称,Perplexity、Airbnb、Pinterest及路透社等企业已基于Qwen开展Agent、AI助手或自研模型等应用。