【软盟资讯 · 快讯频道】 8月28日消息,阿里旗下千问团队近日推出全新大模型Qwen3.8-Flash并同步开源模型权重。该模型采用多模态混合专家(MoE)架构,通过激活1250亿参数中的60亿实现性能突破,在多项基准测试中超越Claude Opus 4.6,部分场景接近Opus 4.8。相较于前代Qwen3.7-Plus,新模型训练成本降低90%,推理成本降至每百万Tokens输入1元、输出3元,价格仅为DeepSeek-V4-Flash忙时价格的三分之一。技术层面,Qwen3.8-Flash引入四大创新机制:QSA稀疏注意力与GDN融合架构使1M Tokens长上下文处理速度提升8倍;自研Gated Residual方法将传统Transformer单通道拆分为四条动态路径;51B规模N-gram Embedding实现”外挂式记忆指南”;结构与训练协同设计使收敛效率提升3倍。目前Qwen系列模型全球下载量已突破30亿次。(来源:ITBear、快讯)
软盟点评: Qwen3.8-Flash的发布,标志着大模型竞争的核心指标正在从”参数量”切换到”Token效率”。用60亿激活参数对抗千亿级模型,训练成本降90%、推理价格仅为竞品三分之一,这种”以小博大”的打法,直接印证了行业正在从”参数秀”走向”成本账”。当推理成本被压到每百万Token输入1元、输出3元时,AI应用的商业门槛被大幅拉低,更多中小企业和开发者将有能力把AI嵌入真实业务。这也再次凸显了开源生态的价值——Qwen系列下载量突破30亿次,正推动中国大模型技术加速全球化渗透。