阿里开放 Qwen3.8-2.4T-A95B 模型权重

大模型之家讯 8月12日深夜,阿里云魔搭 ModelScope 社区宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源权重。该模型总参数 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,可扩展至 1,010,000 Token;每个 MoE 层含 512 个专家,每 Token 选择 10 个路由专家并激活 1 个共享专家,并采用多步 MTP 训练支持多 Token 预测。

Qwen3.8 延续 Qwen3.5 混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方云端版 Qwen3.8-Max 基于该权重并加入更多生产环境能力,在编程 Agent、通用 Agent、专业工作与长上下文等评测中与 Opus 4.8、Fable 5、GPT 5.6 Sol 互有高低,并于 PaperBench、IFBench 等 Benchmark 中取得较高成绩。

上一篇:

下一篇:

发表回复

登录后才能评论