阿里开源千问Qwen3.8-Flash:训练成本暴降90%,定价仅为DeepSeek-V4-Flash三分之一

by ebc外汇平台官网date 2026-08-27views 29

8月26日夜间,阿里巴巴正式推出新一代千问大模型Qwen3.8-Flash,并同步将其模型权重向全球AI社区开放。这是千问系列在模型架构和训练方案上的一次全面革新,被视为下一代Qwen4的重要前奏。

据官方公布的信息,得益于底层架构重构与训练流程的深度优化,Qwen3.8-Flash的训练成本相比Qwen3.7-Plus降幅接近九成,推理成本也大幅缩减。具体来看,在百万Tokens计费模式下,输入费用仅为1元,输出费用为3元,整体价格低至DeepSeek-V4-Flash的三分之一,具备极强的成本竞争力。

作为一款多模态混合专家(MoE)模型,Qwen3.8-Flash采用与此前所有千问大模型截然不同的架构设计。在注意力机制层面,它引入了全新的QSA(Qwen Sparse Attention)模块,并与GDN机制深度融合,形成高效混合注意力架构,显著降低计算开销。实测数据显示,在1M Tokens长上下文且高缓存命中的真实场景中,推理速度可提升超过8倍。同时,模型结构与训练策略协同优化,使收敛速度和训练吞吐量均获得大幅跃升。

值得关注的是,Qwen3.8-Flash所采用的Next新架构将成为新一代千问大模型Qwen4的雏形。目前,该模型的权重已完整上架Hugging Face与魔搭社区,面向全球开发者全面开源,供技术社区验证和二次创新。

截至发稿,千问系列已累计开源Qwen3.8-Max、Qwen3.8-27B和Qwen3.8-Flash三大尺寸模型,总参数量达到2.4T。数据显示,Qwen模型全球下载量突破30亿次,衍生模型数量超过30万个,全尺寸、全模态的开源格局正进一步扩大中国大模型在全球AI生态中的影响力。