ITCOW牛新网 8月13日消息,阿里 Qwen 团队昨夜通过魔搭 ModelScope 社区放出 Qwen3.8-2.4T-A95B 的开放权重,这是 Qwen-Max 量级模型第一次把完整权重交到开源侧,总参 2.4T、单 token 激活 95B,原生上下文 262144 token,经扩展机制可拉到 101 万 token。

架构上它沿用 Qwen3.5 的混合路线,每一层 MoE 铺 512 个专家、每 token 挑 10 个路由专家加 1 个共享专家,并做了多步 MTP(Multi-Token Prediction)训练,能配合支持该机制的推理引擎一次揣出多个后续 token,对长文本续写与 Agent 多步执行都有提速。官方云端版 Qwen3.8-Max 就是在这份权重上再叠生产环境后训练得到的,侧重点落在编程、办公、科研与跨天级 Agent 任务的端到端闭环。评测表里它和 Opus 4.8、Fable 5、GPT 5.6 Sol 互有胜负,在 PaperBench、IFBench 等基准上拿到同组最高分。
据ITCOW牛新网了解,Qwen3.8-Max 的后训练把办公与 Agent 能力拆成三件事做:环境维度按任务(单→多→跨天)、工作空间(多文件→层级目录→异构目录)、Harness(类别/版本/技能)解耦组合,让训练环境数自然膨胀而不靠人手逐个集成;奖励系统把执行校验、文本与渲染图 rubric 打分、agentic 检查融进同一套信号,免去每种任务各养一个 verifier 的偏差;在线数据均衡器按 batch 重排分布,压住任务难度与环境的方差,使 RL 训练算力能稳定往外扩。模型权重、技术 blog、Qwen Studio 对话入口同步挂出,开发者可从 ModelScope 直接拉 Qwen/Qwen3.8-2.4T-A95B。