8月22日,全球知名AI模型评测机构Artificial Analysis发布最新榜单,阿里巴巴通义千问团队研发的Qwen3.8模型在Agentic能力(智能体能力)评测中以总分92.3分位列全球第一,超越OpenAI、Google等国际巨头同期产品。该榜单综合评估了模型在任务规划、工具调用、多步推理及环境交互等核心维度的表现,Qwen3.8在工具调用准确率(98.7%)和复杂任务成功率(91.5%)两项关键指标上均刷新纪录。
此次登顶标志着中国AI大模型在智能体这一前沿赛道实现领跑。Agentic能力被视为下一代AI的核心竞争力,它让模型不仅能“思考”,更能“行动”——自主拆解任务、调用API、操作软件,甚至协作完成跨领域工作流。业内分析指出,Qwen3.8的突破得益于阿里在强化学习与多模态对齐技术上的持续投入,以及其开源生态的协同效应。
目前,Qwen3.8已通过阿里云百炼平台向开发者开放,并集成至钉钉、通义千问App等产品中。阿里巴巴集团首席技术官吴泽明表示:“我们正加速推动智能体技术落地,让AI成为每个人高效工作的数字同事。”随着Qwen3.8的领先表现,全球AI竞争格局正从单一模型能力比拼,转向智能体生态的全面较量。