新闻
刚刚,蚂蚁站在Kimi肩膀上开源了一款新模型
1 分钟阅读
来源:zhidx.com
智东西 作者 | 李水青 编辑 | 心缘 智东西8月11日报道,今日,蚂蚁百灵大模型开源了一款 轻量级混合推理MoE模型——Ling-3.0-tiny。 该模型总参数量为 7.9B ,推理时激活参数量为 1.3B ,主要面向高效 本地部署 而设计。其同步提供 BF16、FP8和INT4 三个版本,已在 DGX Spark、MacBook、Mac mini 等设备上完成验证,兼顾性能、效率与可部署性。 在Artificial Analysis Intelligence Index评价体系中,Ling-3.0-tiny获得25分, 仅比Gemma-4-26B-A4B低1分 ,同时高于 gpt-oss-120B(high)、Qwen3.5-9B、Gemma-4-12B和Gemma-4-E4B。 该模型的关键要点总结如下: 1、高效的混合线性架构: Ling-3.0-tiny采用 月之暗面自研的KDA (Kimi增量注意力)与 DeepSeek自研的MLA (多头潜在注意力)的3:1 交替堆叠结构,并配备由128个路由专家组成的 稀疏MoE前馈网络 ,构建起高效的混合线性架构。 每个Token仅激活8个路由专家和1个共享专家,使该模型能够在长上下文建模能力、参数效率与计算成本之间实现平衡。 2、原生混合推理与智能体能力: Ling-3.0-tiny兼顾 快速响应 与 多步推理 能力,可通过enable_thinking参数在单次请求中灵活开启或关闭思考模式。该模型在通用智能体任务、代码生成、数理科学推理以及指令遵循场景下均具备均衡表现。 3、本地与边缘部署: 在FP8精度下,Ling-