News

Date: 2026-09-19

中电信人工智能科技有限公司正式发布新一代星辰大模型:Xing4.0-29B-A4B。Xing4.0 在历经原TeleChat三代研发的基础之上全面升级,延续坚持全栈国产自主研发的技术底色,从模型架构、训练Infra到能力范式实现全面跃迁。凭借自研高性能通用GPU与MXMACA软件栈一体化协同的产品优势,沐曦股份率先完成对Xing4.0-29B-A4B的Day 0适配,实现“上线即适配”


自2025年12月以来,沐曦股份已完成38个主流顶尖模型Day 0适配。范围涵盖智谱AI、阿里千问、MiniMax、DeepSeek、阶跃星辰、腾讯混元等头部厂商,适配速度、数量、生态广度均位居行业前列。


Xing4.0:从“会回答”走向“会做事”


Xing4.0-29B-A4B总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K,是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。


综合来看,Xing4.0-29B-A4B 在较小参数规模下实现了较强的智能体能力。在任务规划、工具调用、代码处理和端到端任务执行等方面表现突出,为数据处理、办公自动化等智能体应用提供了良好的模型基础。



在编码Agent方面,Xing4.0-29B-A4B 在 SWE-bench Verified(75.0)、SWE-bench Multilingual(66.0)和 Terminal-Bench 2.1(57.5) 上表现突出。其中,SWE-bench Verified(75.0)接近 Qwen3.6-35B-A3B(76.0),大幅超过 Gemma4-26B-A4B(53.0);Terminal-Bench 2.1(57.5)同时超过 Qwen3.6-35B-A3B(51.5)和 Gemma4-26B-A4B(30.0)。


在通用Agent方面,Xing4.0-29B-A4B 在 Claw-Eval(76.55)、DeepresearchBII(60.80)和 τ³-Bench(64.63)上展现出较强表现。其中,Claw-Eval(76.55)超过 Qwen3.6-35B-A3B(74.54)和 Gemma4-26B-A4B(71.49),DeepresearchBII(60.80)也超过 Qwen3.6-35B-A3B(59.70)和 Gemma4-26B-A4B(39.30)。



以上是针对智能体场景小尺寸模型对比结果,从 SuperCLUE 评测结果来看,在智能体能力方面,Xing4.0-29B-A4B 得分 93.52,位列第 3 名,与两款头部 Qwen 模型的差距均不足 1 分。


国产底座全栈赋能,加速模型落地闭环


此次成功完成Day 0适配,充分验证了沐曦自研MXMACA 软件栈的卓越兼容性与深度优化能力。作为 “自主 GPGPU 硬件 + 全栈软件体系” 的核心枢纽,MXMACA软件栈承担着连接底层算力硬件与上层 AI 应用生态的关键纽带作用。它不仅全链路覆盖底层驱动、用户态接口、MXCC 编译器、算子深度适配、主流训练/推理框架对接及行业场景专项优化。目前,MXMACA软件栈已实现对主流AI生态的广泛覆盖:兼容支持40余种AI框架、1000多款模型,适配超6000个开源项目测试,全量支持PyTorch 2.8的2410个GPU算子。


未来,沐曦股份将长期致力推动国产算力从“可用”走向“好用”“易用”,持续深化与国内顶尖AI团队的技术协同,构建自主可控、高效繁荣的国产AI生态。

  • Business CooperationBusiness@metax-tech.com
  • Investor Relationsir@metax-tech.com