阿里大模型提速:Qwen4已投入训练 下一代视频生成模型11月发布
产联社编辑 | 开蓉蓉

【产联社】阿里大模型取得多项突破。9月22日,2026云栖大会在杭州开幕。阿里巴巴集团公布大模型领域系列进展,并称正以更高智能与极致性价比为目标,加速向通用人工智能(AGI)乃至超级人工智能(ASI)迈进。
阿里披露,基于下一代架构的Qwen4已投入训练,未来Qwen4.5、Qwen5等版本模型参数将扩展至5万亿至10万亿规模;大模型递归自我改进(RSI)已初步进入模型训练、推理及芯片协同等环节;多模态模型矩阵全面升级,下一代视频生成模型将于11月发布。

Qwen4训练,RSI零人工迭代
本届云栖大会最受关注焦点之一是阿里大语言模型系列迭代路线图。Qwen LLM项目负责人刘大一恒表示,Scaling是迈向ASI的关键路径,Qwen4.5、Qwen5参数规模计划迈向5到10T。
据大会披露,Qwen3.8-Max在编程与办公领域表现强劲,发布后即斩获Artificial Analysis Agentic智能体第一、Code Arena前端编程第一。
在最新Artificial Analysis全球大模型排行榜上,Qwen3.8-Max得分从40分提升至45分,与Claude、GPT等顶尖模型同处第一阵营,领先于GLM5.3、Kimi-K3等所有国产模型。
更值得关注的是,阿里在大模型自我进化(RSI)领域取得实质性突破。
传统模型迭代通常依赖人工分析、数据准备与训练循环,而Qwen3.8-Max已能通过自主搭建训练流程、构造训练数据、自主设计实验并定位缺陷,在人类完全零参与的情况下持续迭代超1个月,完成33轮有效迭代。基于RSI与后训练等系列技术创新,新版本在Artificial Analysis上的得分提升12.5%。
下一代架构亮相,训练成本降九成
在架构优化方面,Qwen3.8-Flash提前开源下一代千问大模型架构,通过注意力机制和模型内信息传递机制等核心技术创新,在实现前沿模型性能的同时,将训练成本骤降近90%;
同时依托极少的参数激活,将推理计算效率推至全新的帕累托前沿,成为行业性价比新杀线模型。
在模态扩充方面,全模态模型Qwen3.8-Omni-Flash正式亮相,将视频、音频、图片和文字等不同模态高效纳入统一理解框架,为大模型开辟全新的思考分区。
阿里巴巴ATH技术副总裁、淘天集团首席科学家郑波在大会现场表示,三年内会出现一个原生全模态统一模型,体验将不再受限于模态的边界。
多模态模型升级,视频新模型11月发布
多模态模型也是阿里此次集中更新的方向。视频生成领域,Wan3.0支持单次30秒视频生成、文档/表格/网页等结构化输入、原生音画同步,在Artificial Analysis文生视频与视频编辑双榜位列全球第一。
阿里同时宣布,全新的下一代视频生成模型将于11月发布,具备导演级创作思维,从生成单个镜头迈向理解完整叙事。
语音方面,Qwen-Audio-3.1系列全面升级,覆盖ASR、TTS和Realtime三大赛道,均位列国际第一梯队、国内第一;同声传译模型Qwen3.8-LiveTranslate首次登场,字均延迟从2.8秒降至2.3秒,而人类同传平均时延在4秒以上。
图像生成模型Qwen-Image-3.1则主要面向电商、设计等真实商用场景优化,将原本数小时的视觉设计压缩至秒级交付。音乐模型HappyShrimp1.1支持百余种曲风与十余种主流语言;世界模型最新版本HappyOyster2.0-Preview亮相,显著提升智能实时交互、记忆能力、实时响应、物理规律遵循等核心能力。
开源生态方面,Qwen系列模型均面向全球开源。一个月内,Qwen3.8相关模型已下载超5600万次,衍生模型超1900个。
截至目前,阿里已开源460多个千问大模型,Qwen模型整体下载量超30亿次,衍生模型超30万个。
HuggingFace官方报告指出,Qwen已成为全球AI开源社区的基座模型。硅谷AI独角兽Perplexity基于Qwen3.8打造本地Agent;爱彼迎Airbnb CEO布莱恩·切斯基称公司正大量依赖阿里巴巴的千问模型,并直言比OpenAI更好更便宜;“美国版小红书”Pinterest用Qwen搭建AI购物助手和聊天机器人,以降低成本并基于Qwen开发自有模型。
这些案例显示,除继续扩大基础模型参数和能力外,阿里也在通过Coding、Agent、多模态及开源生态扩大Qwen的实际应用范围。
信息来源说明:2026云栖大会阿里巴巴集团官方披露及财闻报道整理,数据来自大会现场展示及公开信息。
商务合作,请联系侯经理 18801065284(微信同号)
报料及内容合作,请联系chanlianshe2026(微信号)
特别声明:本文仅供参考,不构成任何投资建议,未经允许不得转载。

