Date: 2026-09-19
今年夏天,由中国计算机学会主办的第八届CCF开源创新大赛落下帷幕。本届大赛紧扣人工智能与泛在操作系统领域核心需求,设置四大赛道、21个赛题,吸引了来自全国的3,679名开发者报名参赛,共收到有效作品586份。
其中,由沐曦股份承办并发布赛题的「国产开源GPU AI创新生态赛」备受瞩目,赛道报名人数和有效作品提交数都名列前茅。赛事上线仅8周,报名就已接近300支队伍,此后持续攀升,最终有515支队伍报名参赛,提交近100个作品。
10万元奖金池、免费的沐曦GPU算力、配套的技术直播课程、中期激励活动……五个月的时间,我们和许多开发者一起,在国产GPU上做了一些尝试,也收获了一些值得记录的幕后故事。
许多开发者,因为这场比赛第一次用上了国产GPU。
赛事启动后,我们收到了来自全国各地高校师生、科研人员和行业开发者的报名。三大任务方向——开源软件工程实践、AI Skill与MCP应用开发、AIGC与智能体开发——既照顾了想深入底层技术的同学,也给应用层创新留足了空间。
对很多参赛者来说,这是他们第一次在国产GPU上写代码、跑模型。从环境搭建到算子适配,从框架调优到应用开发,大家在沐曦C500 GPU和MXMACA软件栈上完成了从0到1的实践。我们也通过技术直播课程——如何为开源项目提交PR、如何从零开发一个Agent、如何写一个好用的Skill——尽可能降低大家的入门门槛。
最终,我们收到了一大批高质量的参赛作品。其中既有深入算子库底层的硬核贡献,也有充满创意的应用层探索,覆盖了从基础设施到行业应用的多个层面。
一些获奖者,和沐曦结下了更深的缘分。
比赛结束不是终点。几位在赛事中表现突出的获奖者,已经来到沐曦开始实习,从赛场走向了国产GPU研发的第一线。
这其实也是我们办赛的初衷之一——从赛题设计开始,我们就尽量把“真实产业场景”放在第一位。选手们在比赛中遇到的问题,很多也是一线工程师每天面对的挑战。这种“以赛代练”的模式,让我们有机会认识更多志同道合的年轻人,也让优秀的开发者有机会更深入地了解国产GPU的开源生态。
一些好作品,正在被更多人看见。
比赛中涌现的优秀开源项目,我们不希望它们“拿完奖就归于沉寂”。目前,多个优质项目将被推荐申报「青年开源专项基金种子计划」,希望能获得持续的资金扶持和社区技术指导,推动项目从参赛原型一步步走向成熟的开源产品。
种子计划面向全国遴选优秀青年开源项目,从技术价值、可行性、开源影响力、社区潜力、生态贡献等多个维度进行评审。对这些年轻的开发者来说,这是一份鼓励,也是一份责任。
如果你也正在完成开源项目,期待被看见、被认可,并获得更多成长养分,欢迎投递青年开源专项基金种子计划。我们将为入选项目提供专项资助、生态对接、社区传播与孵化支持,让好项目被看见,让开源种子破土生长。
报名热不热,就看参与度;作品硬不硬,直接看代码。走进几个代表性作品,看看开发者们在沐曦GPU上都做出了什么。
战队:能工智人(湖北工业大学)
作品地址:https://www.gitlink.org.cn/muluzhe/metax-gpu-ops-agent
面向沐曦C500 GPU的运维智能体,通过MCP协议暴露监控、实例管控、作业调度等15个工具,自带Web控制台。用户无需命令行操作,通过自然语言就能完成YOLO模型训练、推理检测、GPU监控和资源管理全流程。
项目实现了一键部署——全新服务器只需Python 3.10+,一个脚本自动安装全部依赖并启动服务。工程质量也比较扎实,全量测试1091个用例全部通过,技术报告、架构文档、API参考一应俱全。
“能工智人”团队汇聚了机械、机器人、计算机、智能制造等多专业力量,打破单一学科边界协同攻关。团队始终坚持以人工智能为使能技术,将算法深度嵌入国产算力运维、轨道交通巡检等真实工程场景。
战队:AI算子优化队
作品地址:https://www.gitlink.org.cn/liyuke/KernelForge
基于Claude Code的自主算子优化系统。通过/optimize命令驱动迭代优化循环,将PyTorch参考实现逐步替换为高性能自定义内核。
系统设计了profiler / inspector / research三个子Agent协同工作,配合权限护栏设计,确保优化过程安全可控。文档质量在参赛作品中比较突出,还配有专门的项目主页和演示视频。
值得一提的是,它同时支持沐曦和NVIDIA双平台——开发者用一套工具链,就能在异构算力环境下完成算子优化,这也体现了开源工具跨平台的价值。
战队:Esperanza
作品地址:https://www.gitlink.org.cn/LindseyMei/InfiniCore
这是一个比较硬核的作品。参赛者为InfiniCore算子库补齐了sigmoid、quickgelu、softmax、lp_norm四个算子的MetaX(沐曦)后端,其中多个PR已提交上游并陆续合入。
更有价值的是一项elementwise模板向量化优化——为共享模板增加16字节向量快路径,让上百个elementwise算子自动受益,silu大张量性能提升3-4倍。
所有改动均在沐曦C500真机上完成编译、单测、精度对拍和性能测试,工程规范严谨,附完整单测、性能数据与设计文档。这不是“为了比赛写的demo”,而是真正能被上游社区采纳的高质量贡献。
战队:MGI
作品地址:https://gitee.com/kimi03/xrd-misfit-research-skill
面向镍基高温合金XRD谱图中的晶格失配识别任务,构建了模型推理→Agent可信决策→Bragg物理复核→策略调参→证据打包的完整科研验证框架。
这不是一个简单的预测脚本,而是一套包含多个workflow工具、Agent工具和验证工具的完整研究流程。在MetaX C500环境验证中,峰位一致性率达到97.6%。
项目还特别注重“科学边界”——明确区分了“已验证的可复现流程”和“尚未证明的最终基准性能”,这种严谨的科研态度在AI应用类作品中比较难得。
战队:包赢队
作品地址:
https://www.gitlink.org.cn/xy111/pixelbead-codex-skill
一个充满创意和温度的作品。输入一张图片,通过部署在沐曦GPU算力环境上的大模型完成抠图、图像类型判断和尺寸规划,再使用内置确定性算法生成可打印的MARD拼豆图纸、预览图、用豆清单。
支持两条路线:卡通/Logo图片直接生成图纸,真人照片先生成Q版中间图再编译。使用RMBG-2.0自动抠图、Qwen3-VL-8B做图像规划、MARD 221色卡做色号匹配,输出带坐标、参考线、色号和用量统计的专业图纸。
战队:lulululudj的战队(独立开发者)
作品地址:https://www.gitlink.org.cn/lulululudj/ThreeChainMamba3
这可能是本届赛事最让人动容的作品。
整个项目——从架构设计、实验迭代到文档写作——全部由一位独立开发者完成。作品提出了“三链DNA-Mamba3”架构:让空间、时间、因果三条异构Mamba链像DNA三螺旋一样扫描同一份时空张量,探索状态空间模型在长程外推中的稳定性。
实验结果比较亮眼:从30M到1.13B参数规模,模型对从未见过的更长序列做外推,性能衰减始终稳定在较小范围内,而同参数的Transformer在同样测试中出现了明显退化。在沐曦C500 GPU上,完成了32个场景的验证实验。
得益于mamba_ssm的计算核全部基于Triton编写,模型可以零修改迁移到沐曦MXMACA软件栈。
三等奖对独立开发者而言,是一份沉甸甸的鼓励。而这份鼓励背后,是我们希望传递的一个信念——无论你是团队作战还是单兵突进,只要代码够硬,就有被看见的机会。
一场赛事如何能吸引这么多开发者参与?沐曦股份做了什么:
参赛即获得免费的沐曦GPU算力,解决了很多高校团队“有想法没机器”的痛点。同时,我们配套了系列技术直播课程——如何为开源项目提交PR和参与社区交流、如何从零到一开发一个Agent、如何写一个更好用的Skill。这些课程不仅服务于比赛,也希望能成为开发者长期可用的学习资源。
很多比赛的痛点是“报名一时爽,提交火葬场”。我们尝试通过中期激励活动,帮助选手更好地把握作品开发的进度节奏,及时发现问题和不足,在后期冲刺阶段提交更高质量的作品。从最终的作品完成度来看,这一机制起到了一定的作用。
比赛结束不是终点。获奖者来沐曦实习、优秀项目推荐进入种子计划、技术课程持续开放——我们希望搭建的是一条“发现人才→培养人才→陪伴成长”的路径。对开发者而言,这不应该只是一次“拿完奖就走”的比赛,而是一个可以长期成长的生态入口。
从运维智能体到算子优化工具,从材料科学Agent到创意拼豆工具,从团队协作战到一个人的三螺旋——这条赛道上涌现的作品,覆盖了底层算子、框架适配、AI Agent、行业应用、创意工具等多个维度,也让我们看到了国产GPU生态的多样性和生命力。
对每一位参赛者而言,这次赛事经历最大的收获在于——你的代码,真的有人在认真看;你的努力,真的能被看见。
如果你也想在国产GPU上写下自己的第一行代码,如果你也有一个想实现的开源创意,欢迎关注沐曦后续发布的赛事和实战课程信息。下一次,站在领奖台上的,可能就是你。
国产GPU开源生态,我们默默灌溉,静待花开!