阿里Qwen3.8-Flash-Next以“6B激活参数”硬刚真实Agent战场,开源模型冲进前7,HuggingFace趋势榜冲到第1!
Qwen3.8-Flash-Next 正式进入 Agent Arena,基于8700多个真实世界代理会话数据,整体净提升达到+2.4%,开源模型中排名第7(全局第24)。它仅落后于开源第6的 DeepSeek V4 Flash (High)(+3%)和第5的 GLM-5.3 (Max)(+3.8%)。在“确认成功”这一关键信号上尤为突出,达到+12.3%,开源第5、全局第7。相比同系列的 Qwen3.8-27B(净提升+1.5%、确认成功+7.2%),它全面领先;而旗舰 Qwen3.8 Max 仍保持更高水位(净提升约+6%、确认成功+10.8%)。
Qwen3.8-Flash-Next 是125B总参数、仅6B激活的超稀疏MoE,还带51B N-gram嵌入,原生262K上下文可扩展到1M,训练成本仅约为前代Qwen3.7-Plus的1/9,却在SWE-bench Pro(62.5)、DeepSWE 1.1(58.7)、CoWorkBench(73.9)、JobBench(55.7)等Agent相关评测上全面领先或大幅超越更大模型。它明确被定位为Qwen4架构的早期预览,采用了Gated DeltaNet + Qwen Sparse Attention混合注意力、Gated Residual等新设计,目标就是在成本和性能之间找到更优平衡点。

