Qwen 正式开放 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构 Qwen 团队 8 月 26 日宣布开放… — AI一线|ShareCentre — TG.ME

AI一线|ShareCentreQwen 上线 Qwen3.8-Flash-Next 预发布页,预告 Qwen4 架构预览 Qwen 官方 Hugging Face 页面已上线 Qwen3.8-Flash-Next 条目,并将其标记为 Upcoming release,副标题为“A Preview of the Qwen4 Architecture”。页面把预期发布时间列为 2026 年 8 月 26 日,并将 Qwen/Qwen3.8-Flash-Next 列为计划产物。 这意味着 Qwen3.8-Flash-Next 已进入公开…
Qwen 正式开放 Qwen3.8-Flash-Next 权重,预览 Qwen4 架构

Qwen 团队 8 月 26 日宣布开放 Qwen3.8-Flash-Next 权重。这是一款多模态 MoE 模型,也是 Qwen4 所用模型结构的先导预览;官方希望社区先检验这套架构,再构建完整 Qwen4 模型家族。

本次升级集中在四个方向:Gated DeltaNet 与 Qwen Sparse Attention(QSA)组成混合注意力,在 micro-block 粒度筛选重要上下文;Gated Residual 将残差流扩展为 4 条分支;N-gram Embedding 通过查表扩展容量,并支持卸载到主机内存;Muon 与 AdamW 的参数分工及 Scaling Law 重新设计。

模型主参数量为 125B,另有 51B N-gram Embedding,每 token 激活 6B 参数;原生支持 262,144 token 上下文,并可用 YaRN 扩展至 1,000,000 token。官方模型卡给出的代表性结果包括 DeepSWE 1.1 58.7、SWE-bench Pro 62.5、CoWorkBench 73.9 和 LiveCodeBench v6 91.9。

Qwen 同时说明,Qwen3.8-Flash 是基于 Flash-Next 的生产服务版本,默认提供 1M 上下文和官方内置工具;本次开放的是 Flash-Next 模型权重。

来源:
https://qwen.ai/blog?id=qwen3.8-flash-next
https://huggingface.co/Qwen/Qwen3.8-Flash-Next
https://github.com/QwenLM/Qwen3.8-Flash-Next
qwen.ai
Qwen Studio
Qwen Studio offers comprehensive functionality spanning chatbot, image and video understanding, image generation, document processing, web search integration, tool utilization, and artifacts.
August 26, 2026 714 2