WAIC现场揭秘:沐曦为何让十大开源社区扎堆展台?

1 阅读

算力硬仗背后的“软实力”突围

在2026年世界人工智能大会(WAIC)的喧嚣中,当超节点、大模型、智能体(Agent)与AI for Science(AI4S)成为展台上的高频词汇时,沐曦的展位却呈现出一种独特的生态景观。这里没有单纯堆砌硬件参数,而是将展台的核心位置留给了十个标志性的开源社区:从底层的龙蜥社区、Red Hat,到框架层的vLLM、PyTorch基金会,再到运营层的模力方舟与木兰开源社区。

这种布局并非简单的品牌联合,而是沐曦对中国算力生态底层逻辑的一次深刻回应。在GPU硬件性能逐渐趋同的今天,真正的竞争壁垒已从单一的制程工艺转向了软件栈的完整性与兼容性。沐曦CTO杨建博士将其核心软件栈MXMACA定义为“AI时代的Android”,旨在通过全链路的开源开放,构建一个通用、好用、易用的底层算力环境。这一战略选择,标志着国产GPU厂商从“追赶者”向“生态共建者”的角色跃迁。

破解CUDA护城河:从“适配”到“共生”

长期以来,NVIDIA凭借CUDA构建的庞大生态形成了极高的迁移门槛。对于国产GPU厂商而言,硬件参数的缩小相对容易,但开发者习惯、代码积累及自研模块的迁移成本却是难以逾越的鸿沟。沐曦的解题思路并非闭门造车,而是通过全栈计算软件MXMACA,将迁移成本压至极限。

数据提供了最有力的佐证:在纳入了GitHub近5000个热门开源项目的自动化测试体系中,92%的项目无需修改一行代码即可在沐曦GPU上正常运行。针对主流框架如PyTorch 2.8,MXMACA实现了2410个GPU算子的完整兼容,且适配周期从行业平均的数月缩短至一周。在vLLM生态中,这种通用性体现得更为明显,大量主流模型无需深度调试即可开箱即用,甚至连在校生也能高效完成大规模验证工作。

然而,仅仅“跑得通”只是第一步。在AI技术迭代速度极快的当下,封闭的软件栈难以跟上开源社区的演进节奏。沐曦选择了一条更具挑战性的道路:将软件栈完全开源,并推行“upstream first”策略。这意味着不再等待上游社区发布新版本后再进行反向适配,而是将沐曦的优化代码直接贡献回上游社区,与社区共同迭代。截至目前,沐曦已开源53个软件仓库,覆盖了软件栈的15%至20%,并持续扩大。这一举措使得开发者在获取最新版本时,无需额外配置即可默认支持沐曦硬件,彻底打通了从代码提交到硬件运行的“最后一公里”。

全栈开源地图:一个Token的生命周期

展台上十个开源社区的排列,实则勾勒出了一个AI Token从生成到交付的完整生命周期。这不仅是技术的堆叠,更是算力基础设施从底层到应用层的全面重构。

在操作系统与资源调度层,沐曦与龙蜥社区、Red Hat等合作,解决了困扰行业多年的内核小版本升级导致驱动失效难题。通过技术机制,GPU驱动能够自动忽略操作系统小版本变化,确保了终端用户的使用稳定性。在训练与推理框架层,vLLM、PyTorch基金会及SGLang等社区的深度共建,推动了性能的指数级增长,过去两年该层级性能提升超过100%。

此外,沐曦还前瞻性地布局了编译器与工具链生态。例如,对北大团队研发的TileLang编译器进行深度共建,使得国内首次拥有了端到端自主可控的并行编译与算子优化技术路线。这种底层技术的开源共享,不仅消除了自研适配代码无法合入上游主干的顾虑,更为后续的性能优化奠定了坚实基础。通过联合上海AI实验室及多所高校开设实战营,沐曦正在将这种技术红利转化为人才红利,累计吸引500多名开发者参与实战,推动产学研用的深度融合。

Agent浪潮下的算力重构与未来愿景

随着智能体(Agent)时代的到来,算力消耗的模式正在发生根本性变化。Token的消耗增速远超底层基础设施的扩容速度,如何提升单位Token的算力效率成为新命题。开源生态在此展现出强大的自我进化能力,通过透明化的技术迭代,如开源社区的快速响应与高校团队的演进优化,使得同一张GPU的Token产出能力从每秒100个提升至300个,同时通过Skill等机制大幅压缩了Agent的调用开销。

沐曦提出的“AI时代的Android”愿景,核心在于降低技术门槛,实现真正的普惠算力。杨建博士指出,理想的生态状态是让小白用户也能在一天内完成新应用的适配与部署。目前,已有案例显示,借助开源文档与AI编程工具,非专业开发人员也能在短时间内完成模型适配。这预示着算力生态正从“专家主导”向“大众共建”转变。

展望未来,沐曦的目标是在2029至2030年将专属生态开发者数量扩展至500万。这不仅是一个数字目标,更是对中国算力生态规模效应的信心展示。通过开源底座串联起操作系统、框架、模型与应用,沐曦试图证明,算力价值的实现不仅取决于硬件的性能极限,更取决于生态的开放程度与协作效率。每一个流畅生成的Token,都是对这套开源协作链路的最佳验证,也是中国算力走向自主可控、开放共赢的缩影。

在这场算力革命的深水区,沐曦选择了一条看似迂回实则高效的路径:不追求单点的硬件超越,而致力于构建一个生生不息的开源生态。正如展台所言,每个Token背后都是一次开源协作,而沐曦希望做的,是让每一次协作都能产生最大的价值,让算力真正服务于每一个创新者。