众力资讯网

阿里首次开源Max级巨无霸!2.4T参数Qwen3.8-2.4T-A95B权重突

阿里首次开源Max级巨无霸!2.4T参数Qwen3.8-2.4T-A95B权重突袭落地,Day-0推理支持+极限量化齐出,直接对标GPT-5.6 Sol级别!

Qwen3.8-2.4T-A95B模型总参数2.4T,每个token仅激活95B,采用512专家MoE架构(每token选10个路由专家+1个共享专家),原生支持262K上下文并可扩展至约1M。模型主打编程、科研、办公与长周期Agent任务。SGLang在发布当日即完成Day-0优化支持(NVIDIA/AMD GPU高吞吐),LMSYS发布技术细节博客,vLLM也同步支持并提供现成4-bit检查点;Unsloth更是通过动态1-bit量化将其从约4.9TB压缩至397GB,宣称性能可媲美GPT-5.6 Sol等前沿闭源模型。