新闻

国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配

1 分钟阅读
快科技9月19日消息, 中电信人工智能科技有限公司日前正式发布新一代星辰大模型Xing4.0-29B-A4B。沐曦股份宣布,依托自研MXMACA软件栈,曦云C系列GPU率先完成对该模型的Day 0适配,实现“上线即适配”。 Xing4.0-29B-A4B是面向智能体时代打造的轻量级代码智能体大模型,采用MOE架构,总参数量29B,激活参数仅4B,原生支持256K上下文,可扩展至512K。 该模型是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型,聚焦任务规划、工具调用和自主执行等能力。 性能方面,Xing4.0-29B-A4B在SWE-bench Verified上得分75.0,Terminal-Bench 2.1得分57.5,均超过同尺寸竞品。 在SuperCLUE智能体能力评测中,该模型以93.52分位列第三,与两款头部Qwen模型差距不足1分。4-bit量化后显存占用降至15GB,RTX 3090、RTX 4090等消费级显卡即可本地运行。 沐曦此次Day 0适配的核心支撑来自MXMACA软件栈。该软件栈全链路覆盖底层驱动、MXCC编译器、算子深度适配及主流训练/推理框架对接,可将传统模型适配周期从数周压缩至小时级。 目前MXMACA已兼容40余种AI框架,适配超1000款模型,全量支持PyTorch 2.8的2410个GPU算子。 自2025年12月以来,沐曦已完成38个主流顶尖模型的Day 0适配,范围涵盖智谱AI、阿里千问、MiniMax、DeepSeek、阶跃星辰、腾讯混元等头部厂商,适配速度、数量与生态广度均位居行业前列。