8月26日,阿里巴巴发布并同步开源千问最新模型Qwen3.8-Flash。该模型采用全新下一代架构,以千亿总参数激活60亿(6B)的极低计算量,即可获得超越Claude Opus4.6的前沿性能,创下模型效率的全球新基准。
得益于架构与训练的全面革新,Qwen3.8-Flash训练成本较前代Qwen3.7-Plus骤降近90%,推理成本亦大幅下降,每百万Tokens输入仅需1元、输出3元,价格最低至DeepSeek-V4-Flash的三分之一。该模型今晚将首发上线“千问办公”,开发者和企业亦可通过千问AI平台获取API服务。