Qwen:Blog Retrieval(API) · 2026/8/26

通义千问开源 Qwen3.8-Flash-Next:Qwen4 架构早期预览,编码与办公能力更强

通义千问开源 Qwen3.8-Flash-Next:多模态 MoE 模型,Qwen4 架构早期预览。采用 GDN+QSA 混合注意力等四项升级,总参数 125B,激活 6B,训练成本约为 Qwen3.7-Plus 的 1/9,编码与办公任务能力更强。

通义千问开源 Qwen3.8-Flash-Next,这是一款多模态 MoE 模型,也是 Qwen4 架构的早期预览。该模型采用 GDN + QSA 混合注意力等四项升级,总参数规模为 125B,每个 Token 激活 6B 参数,训练成本约为 Qwen3.7-Plus 的 1/9。官方表示,其在编码与办公任务上的能力更强。

FDE 判断

该开源模型强化编码和办公任务能力,训练成本约为 Qwen3.7-Plus 的 1/9,有助于降低企业定制模型的门槛和资源需求。FDE 可关注 Qwen4 架构演进,提前评估其在客户交付场景中的适用性与集成方式。