9月22日,2026云栖大会开幕,阿里巴巴公布大模型最新进展。在大语言模型领域,Qwen3.8-Max在编程与办公领域表现强劲,发布后斩获Artificial Analysis Agentic智能体第一、CodeArena前端编程第一。基于下一代架构的Qwen4已投入训练,未来Qwen4.5、Qwen5等后续版本模型参数将扩展至5到10万亿。

在多模态领域,Qwen-Image-3.1性能有望逼近最强GPT-Image系列,跻身全球前列;Qwen-Audio-3.1在ASR、TTS以及Realtime三个核心语音赛道均位列国际第一梯队、国内第一,超越Gemini 3.1 TTS等国际顶尖模型;世界模型HappyOyster-2.0-Preview全新亮相,推动世界模型从实验室走向真实可用;视频生成模型Wan3.0斩获Artificial Analysis文生视频与视频编辑双榜第一,下一代视频模型也在训练中,拥有更强的生成力、控制力和理解力。

阿里公布,大模型自我进化(RSI)已初步进入模型训练、推理及模型芯片协同等环节。Qwen3.8-Max可通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,在人类完全“零参与”的情况下持续迭代超1个月,完成33轮有效迭代,新版本在Artificial Analysis上的得分提升12.5%至45分,与Claude、GPT等顶尖模型同属前沿梯队。

在推理优化上,Qwen3.8在平头哥新款GPU上自主适配优化了下代架构Qwen3.8-Flash新模型的SGlang推理框架,实现单实例推理吞吐量提升96%。在芯片模型协同设计上,Qwen3.8仅基于一份真实的总线模块规范,自主展开前端、验证、后端的全链路自迭代,在自主运行超60小时、调用EDA工具超万次后,完成减少42%面积的物理实现优化,标准单元数降低29%,功耗降低59.5%。

此外,Qwen3.8-Flash提前开源下一代千问大模型架构,将训练成本骤降近90%;全模态模型Qwen3.8-Omni-Flash正式亮相,将视频、音频、图片和文字等不同模态纳入统一理解框架。阿里表示,追求更高智能并加速自我进化,以及追求极致性价比、推动AI普惠,是Qwen最重要的北极星目标。