贾扬清再创业:Intent Lab如何以6.3倍性能重塑AI基础设施范式
人工智能基础设施(AI Infra)的演进逻辑正在经历一场深刻的底层重构。曾经,这一领域的核心命题围绕算力调度、GPU利用率优化以及多云部署的复杂性展开;如今,随着Agentic Coding(智能体编程)工具的爆发式增长,传统的“封装复杂性”策略正面临被代码自动生成直接绕过的系统性挑战。杨立昆(Jia Yangqing,即贾扬清)离开英伟达后,联合多位开源领域资深专家创立Intent Lab,其发布的Fleet平台不仅展示了GLM-5.2推理引擎6.3倍的性能提升,更标志着AI Infra的价值锚点从“管理算力”向“构建自主系统”的根本性转移。

从算力抽象到系统自主化:Infra范式的代际跃迁

回顾过去十年,杨立昆的职业轨迹清晰地勾勒出AI基础设施发展的三个阶段:从Caffe和PyTorch奠定深度学习框架基础,到LeptonAI降低GPU部署门槛,再到如今Intent Lab试图让AI自主构建生产级软件。这一转变并非简单的业务线更迭,而是对Infra层价值重估的必然结果。
在2023年,解决大规模AI集群管理的复杂性曾被视为价值数亿美元的赛道。然而,随着Cursor、Claude Code等智能体编码工具的成熟,开发者能够以自然语言描述需求,由AI Agent自动生成、调试并部署完整的基础设施代码。这种“代码生成替代产品封装”的趋势,使得那些仅停留在降低工程门槛的工具层平台失去了核心竞争力。正如杨立昆所言,现在的目标不再是“精心架构一个系统”,而是构建一个“能一次产出一千个系统的系统”。
Intent Lab的Fleet平台正是这一理念的执行者。它被定义为“全球第一个将意图转化为生产级软件的自主团队”。在这个架构中,用户不再下发具体的代码指令,而是提出高层业务目标。随后,一组智能体将自主完成需求理解、架构设计、编码实现、形式化验证及后续演进。这种从“人写代码,AI辅助”到“AI自主造系统”的范式转移,解决了传统Infra无法应对的深层稀缺性问题——即AI对模糊意图的拆解能力与复杂系统的正确性保障能力。

硬核验证:性能优化的自动化闭环
Fleet平台首批展示的成果中,GLM-5.2推理引擎的性能突破最具代表性。在两台Grace Blackwell节点上,该系统将输出速度从102 tokens/s提升至647 tokens/s,实现了6.3倍的性能飞跃。这一成果并非简单的参数调优,而是Fleet作为“自动化系统工程循环”的典型体现。
任务起点仅是一句高层意图:在英伟达高度优化的TensorRT-LLM体系基础上榨取更多性能。Fleet首先进行瓶颈分析,随后自主提出方案、实现代码并验证结果。其优化策略涵盖了四个硬核维度:

首先,在内核层,通过Kernel Fusion技术以及直接生成PTX和SASS指令,使Agent能够绕过普通编译器路径,获取更细粒度的指令级控制权限。其次,在运行时优化层面,利用H2D Batching技术大幅减少稳定Decode阶段CPU到GPU的元数据拷贝,降低调度开销。再次,通信优化方面,将Residual Add和RMSNorm融合进All-Reduce操作中,减少了每一层内核启动和内存往返次数。最后,通过改进投机解码(Speculative Decoding)策略,配合更高效的Drafting模型,实现批量验证多Token提议,显著提升吞吐。
关键在于,Fleet并非依赖人类预设的优化规则库,而是模拟了人类专家的系统工程思维:分析瓶颈、提出假设、实施验证、失败回退、成功后迭代。这种闭环能力使其能够处理TensorRT-LLM这一复杂遗留系统的深度优化,证明了Agent在硬核系统编程中的可行性。
正确性与可靠性的重新定义:数据库与文件系统的突破
如果说推理引擎展示了Fleet在性能优化上的能力,那么数据库引擎和分布式文件系统则揭示了其在复杂系统正确性验证上的核心竞争力。在软件工程领域,写出“能运行”的代码与写出“生产级”软件之间存在巨大鸿沟,后者要求对边界条件、并发状态和历史兼容性具备极致的把控力。
Intent Lab展示的第二项成果是生成并通过600万条SQLite兼容性测试的数据库引擎。数据库系统的复杂性在于其不仅涉及SQL语义执行,还涵盖存储结构、事务行为及极端输入处理。Fleet通过将生成的代码置于严格的测试体系中,进行多轮修正,直至其行为逼近真实生产环境的要求。这种“测试驱动生成”的模式,有效克服了传统Coding Agent在复杂逻辑中容易产生隐蔽Bug的缺陷。

第三项成果AgentFS,一个专为AI Agent设计的分布式文件系统,进一步体现了对状态一致性和高并发负载的支持。传统云存储方案(如Amazon EFS)在面对Agent高频、小文件、强并发的读写需求时,往往性能瓶颈显著。Fleet从零构建了AgentFS,在目录创建、文件读取等基础操作上实现了数十倍乃至数百倍的性能提升,部分场景下速度超过EFS 600倍。

更具突破性的是其形式化验证机制。Fleet对核心协议进行了约190万个状态的形式化验证,结合300个集成测试、故障注入及模糊测试,覆盖了崩溃、竞态条件等极端情况。在此过程中,Fleet甚至发现并修复了一个传统Coding Agent在分布式文件操作中导致数据损坏的Bug。这一案例确凿地证明,AI基础设施的新分水岭不在于生成代码的速度,而在于系统能否自我验证、自我纠错,并在复杂状态下保持数据的一致性。
AI Infra的新竞争格局:从辅助工具到建造主体
杨立昆的再创业路径揭示了一个清晰的行业趋势:AI Infra的竞争正在从“帮助人类管理基础设施”转向“让AI成为基础设施的建造主体”。当Agentic Coding成为常态,传统中间件层封装复杂性的价值将被AI自身吞噬,真正稀缺的是让AI理解意图、拆解架构、持续验证的深层系统能力。
这种转变对未来软件形态的影响深远。软件将变得更加碎片化和专业化,因为Infra层正在解构将人类意图翻译为机器可执行规则的中间环节。Intent Lab的Fleet平台并非仅仅是一个代码生成工具,而是一支具备工程协作流程、性能调优能力和形式化验证体系的虚拟研发团队。
对于行业而言,这意味着Infra层的创业机会不再局限于提供更易用的GPU云或部署平台,而在于构建能够支撑大规模、高可靠性、自主演进系统的基础设施架构。谁能在“意图到系统”的自动化链条上建立技术壁垒,谁就能定义下一代AI基础设施的标准。Intent Lab的尝试表明,AI不仅是生产力的提升者,更是基础设施本身的缔造者。这一范式的落地,将彻底重塑软件工程的底层逻辑,使“自主构建生产级软件”从理论走向现实。