新闻
阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文
1 分钟阅读
来源:ithome.com
IT之家 8 月 13 日消息,阿里云“魔搭 ModelScope 社区”公众号昨天(12 日)深夜宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。 此次是 Qwen-Max 级别的模型首次开源权重:模型总参数为 2.4T,每个 Token 激活 95B 参数, 原生支持 262,144 Token 上下文,并可扩展至 1,010,000 Token 。 Qwen3.8 延续 Qwen3.5 的混合架构,重点提升 编程、办公、科研和长周期 Agent 任务 的端到端完成能力。官方云端版 Qwen3.8-Max 基于该开放权重模型,并加入更多生产环境能力。 官方公布的评测覆盖编程 Agent、通用 Agent、专业工作和长上下文等方向;与 Opus 4.8、Fable 5、GPT 5.6 Sol 等模型相比,各项结果 互有高低 ,并在 PaperBench、IFBench 等 Benchmark 中取得所列模型中的较高成绩。 IT之家附上有关链接如下: 模型: https://modelscope.cn/models/Qwen/Qwen3.8-2.4T-A95B blog: https://qwen.ai/blog?id=qwen3.8 Qwen Studio: https://chat.qwen.ai Qwen3.8-2.4T-A95B 是一个因果语言模型,总参数为 2.4T,每个 Token 激活 95B。模型每个 MoE 层包含 512 个专家,每个 Token 选择 10 个路由专家,并同时激活 1 个共享专家。 模型还进行了多步 MTP