基元律动推‘中国版OpenRouter’:多模型智能路由如何重塑AI基础设施?
近年来,随着大模型数量激增和能力分化,AI应用开发正从“单模型依赖”迈向“多模型协同”的新阶段。在此背景下,AI基础设施层的价值日益凸显。2026年8月,国内AI基础设施公司基元律动(TokenRhythm)宣布完成数千万美元新一轮融资,由弘晖基金领投,聚合资本、尚势资本等跟投。此前,其种子轮已获Granite Asia、鼎晖VGC、元璟资本等机构支持。伴随融资消息,公司同步启动TokenRhythm API平台公测,明确对标国际知名多模型路由平台OpenRouter,但聚焦中国市场,打造“中国版OpenRouter”。
TokenRhythm API的核心价值在于解决开发者在多模型调用中的碎片化痛点。当前主流大模型如OpenAI、Claude、通义千问、文心一言、Kimi等,各自拥有独立的认证体系、接口协议和计费逻辑。开发者若需在应用中灵活切换或组合使用多个模型,往往需要重复注册、适配不同SDK、管理多套账单,极大增加工程复杂度。TokenRhythm通过统一API入口,兼容OpenAI和Claude主流协议,允许开发者仅凭一个API Key即可无缝调用数十种模型,显著降低集成门槛。
更关键的是,该平台不仅提供基础聚合功能,还内置模型发现、智能筛选、统一计费、用量统计与调用日志等能力。这意味着开发者不仅能“用得上”,还能“看得清”——清晰掌握各模型在实际业务中的性能表现、成本消耗与用户反馈。据官方披露,平台公测期间已积累5.4万名用户,单日Token调用量突破5000亿,显示出强劲的市场需求与技术承载力。
然而,基元律动的野心不止于成为“模型超市”。公司CEO王云鹤指出,未来AI竞争的关键并非单一模型的绝对性能,而在于如何高效组织多个模型协同完成复杂任务。这一判断催生了其核心技术理念——Routing Harness(路由框架)。与传统Model Gateway仅解决接入与切换不同,Routing Harness深度嵌入Agent任务执行流程,在任务类型、执行阶段、预算约束和实时状态等多维信息驱动下,动态决策“何时用哪个模型”、“是否需要切换”、“如何融合结果”,从而在效果与成本之间实现帕累托最优。
为验证这一理念,基元律动推出了开源AI Agent框架OpenSquilla。该软件支持Windows、macOS、Linux等多平台一键部署,目前已在GitHub获得超6600星标、17万次克隆,并实现超1万台真实设备安装。在权威评测中,OpenSquilla的表现尤为亮眼:在PinchBench数据集上,采用Query级智能路由后,相同任务精度下的调用成本仅为传统任务级路由方案的约1/9;而在DRACO复杂研究任务评测中,由多个国产大模型组成的集成系统,以约三分之一的成本超越了Fable 5的测试成绩。
这些数据背后,是Routing Harness对任务粒度的精细控制能力。传统方案通常在任务开始前选定一个模型全程执行,而Query级路由则能在任务内部的每个子查询(sub-query)层面进行模型选择。例如,在一个包含事实检索、逻辑推理和创意生成的复合任务中,系统可分别调用擅长知识问答的模型、强推理模型和高创造性模型,避免“大材小用”或“力不从心”的资源错配。
值得注意的是,基元律动正尝试将这一闭环进一步延伸——从“组织模型”走向“反哺模型”。Routing Harness在真实Agent任务中持续收集三类关键数据:一是模型选择决策日志,记录在何种上下文下选择了哪个模型;二是任务执行结果,包括成功与否、输出质量;三是成本与延迟指标。这些数据经过脱敏与结构化处理后,可训练更精准的路由策略模型,甚至为“Agent-Native Model”(专为Agent任务设计的大模型)的研发提供训练信号。
这种“数据飞轮”效应,使其区别于单纯的API聚合商。后者仅作为通道,而基元律动试图构建一个具备学习与进化能力的智能调度中枢。长远来看,这可能催生一种新型AI基础设施范式:不再被动适配现有模型,而是主动引导模型演进方向,使其更契合Agent工作流的需求。
在中国市场,这一路径更具战略意义。当前国产大模型百花齐放,但普遍存在同质化竞争与场景适配不足的问题。TokenRhythm通过统一接入层,为国产模型提供了公平的曝光与验证机会。开发者无需因接口差异而放弃尝试新兴模型,模型厂商也能通过平台快速获取真实应用场景反馈。这种“基础设施+生态赋能”的双轮驱动,有望加速国产模型的迭代与分化。
此外,统一计费与用量监控功能也契合企业级客户对合规性与成本管控的需求。在金融、政务、医疗等强监管领域,多模型调用若缺乏透明审计机制,极易引发数据泄露或预算失控风险。TokenRhythm提供的集中化管理界面,使企业IT部门能够清晰追踪每一笔Token消耗的来源与用途,满足内控要求。
当然,挑战依然存在。首先是模型覆盖广度与更新速度。尽管平台已支持主流国内外模型,但面对每日涌现的新模型,如何快速完成协议适配与性能基准测试,考验其工程响应能力。其次是路由策略的泛化性——在未见过的任务类型上,系统能否做出合理决策?这依赖于底层策略模型的鲁棒性与持续学习机制。
另一个潜在瓶颈是生态绑定风险。若平台过度优化特定模型组合,可能导致开发者对其产生路径依赖,削弱模型市场的自由竞争。对此,基元律动强调其中立立场,承诺不干预模型排序,仅基于客观指标(如延迟、成本、历史准确率)进行推荐,并开放路由策略自定义接口,允许高级用户注入自有规则。
展望未来,随着Agent应用从实验走向规模化落地,多模型协同将成为标配。基元律动所构建的Routing Harness,本质上是在AI时代重新定义“操作系统”——不是管理硬件资源,而是调度智能资源。在这个新范式下,最强的不是单个模型,而是那个最懂如何组合模型的“指挥官”。
可以预见,类似TokenRhythm的基础设施层玩家,将在AI产业链中扮演越来越关键的角色。它们不直接生产模型,却决定了模型如何被使用;不面向终端用户,却深刻影响着每一个AI应用的体验与成本。在大模型“军备竞赛”之外,一场关于智能调度与协同效率的“隐形战争”已然打响。而基元律动,正试图在这场战争中占据制高点。