Qwen 正式开放 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构
Qwen 团队 8 月 26 日宣布开放 Qwen3.8-Flash-Next 权重。这是一款多模态 MoE 模型,也是 Qwen4 所用模型结构的先导预览;官方希望社区先检验这套架构,再构建完整 Qwen4 模型家族。
本次升级集中在四个方向:Gated DeltaNet 与 Qwen Sparse Attention(QSA)组成混合注意力,在 micro-block 粒度筛选重要上下文;Gated Residual 将残差流扩展为 4 条分支;N-gram Embedding 通过查表扩展容量,并支持卸载到主机内存;Muon 与 AdamW 的参数分工及 Scaling Law 重新设计。
模型主参数量为 125B,另有 51B N-gram Embedding,每 token 激活 6B 参数;原生支持 262,144 token 上下文,并可用 YaRN 扩展至 1,000,000 token。官方模型卡给出的代表性结果包括 DeepSWE 1.1 58.7、SWE-bench Pro 62.5、CoWorkBench 73.9 和 LiveCodeBench v6 91.9。
Qwen 同时说明,Qwen3.8-Flash 是基于 Flash-Next 的生产服务版本,默认提供 1M 上下文和官方内置工具;本次开放的是 Flash-Next 模型权重。
来源:
https://qwen.ai/blog?id=qwen3.8-flash-next
https://huggingface.co/Qwen/Qwen3.8-Flash-Next
https://github.com/QwenLM/Qwen3.8-Flash-Next
qwen.ai
Qwen Studio
Qwen Studio offers comprehensive functionality spanning chatbot, image and video understanding, image generation, document processing, web search integration, tool utilization, and artifacts.

August 26, 2026 714 2