Qwen3.8-Flash-Next 发布:125B 多模态 MoE 模型预览 Qwen4 架构
一句话结论:阿里 Qwen 团队发布 Qwen3.8-Flash-Next,一个 125B 参数的多模态 MoE 模型,仅 6B 激活参数,并预览了 Qwen4 架构。原始信息详细拆解了参数分布:125B 主干、51B N-gram 嵌入表、4B 多 token 预测模块,每 token 仅激活 6B 参数。架构上引入了 Gated DeltaNet 与 Qwen Sparse Attention 的混合、Gated Res 等四项关键变化。为什么值得关注:这是 Qwen4 架构的首次公开预览,MoE 设计大幅降低推理成本,同时多模态能力可能带来更广泛的应用场景。影响谁:关注高效模型架构的研究人员、需要低成本多模态能力的开发者,以及使用 Qwen 系列模型的企业。下一步验证:可以等待模型权重开放后,在本地或云端测试其推理速度和多模态任务表现,并与现有 Qwen 模型对比。