哈萨比斯退居幕后:Koray接棒谷歌AI,能否扭转Gemini败局?
谷歌AI权力更迭背后的务实主义转向
当Demis Hassabis宣布卸任Google DeepMind CEO并转任董事长时,科技界的目光并未完全聚焦于这位诺贝尔奖得主的光环,而是迅速投向了那个接手日常运营的新名字:Koray Kavukcuoglu。这一人事变动并非简单的职位交接,而是谷歌在人工智能竞争进入白热化阶段后,战略重心从“仰望星空”向“脚踏实地”转移的明确信号。在Jeff Dean离职创业、核心研究员纷纷出走的背景下,Koray的上位被视为谷歌试图稳住阵脚、加速技术商业化的关键举措。
外界对Koray的认知往往停留在“哈萨比斯亲信”或“DeepMind二号人物”的标签上,但这种看法低估了其作为技术操盘手的独立价值。与Hassabis擅长定义宏大愿景、凝聚顶尖科学人才不同,Koray的核心竞争力在于将前沿研究成果转化为可规模化部署的产品能力。在Gemini模型面临OpenAI和Anthropic双重夹击、市场声量逐渐减弱的当下,谷歌需要的不再仅仅是另一篇登上《Nature》封面的论文,而是一个能够按时交付、稳定运行且具备成本优势的工业级AI系统。Koray正是那个能打通实验室与产品线之间“最后一公里”的人。
这种转变反映了大型科技公司在大模型时代的普遍焦虑。基础研究允许漫长的试错周期,但市场竞争却以月甚至周为单位计算胜负。Koray的直接汇报对象是CEO Sundar Pichai,这一架构调整意味着AI研发不再是孤立的科学探索,而是深深嵌入谷歌搜索、Android、Cloud等核心业务的生命线中。他的任务非常具体且艰巨:协调原DeepMind与伦敦团队的文化冲突,统一技术路线,并在有限的算力资源下实现模型性能的最大化。这不仅是技术的博弈,更是组织管理的极限挑战。
从LeCun门徒到深度强化学习奠基人
追溯Koray的技术根源,必须回到他在纽约大学攻读博士的那段时光。师从深度学习三巨头之一的Yann LeCun,奠定了他坚实的学术基础。在那个手工特征工程仍占主导的年代,Koray致力于研究如何让机器自动从数据中学习多层视觉特征。他的博士论文《Learning Feature Hierarchies for Object Recognition》探讨了从边缘纹理到复杂形状的逐层识别机制,这一理念如今已成为计算机视觉领域的常识,但在当时却是极具前瞻性的探索。
2012年加入DeepMind后,Koray迅速展现了将理论转化为突破性成果的能力。他组建的深度学习团队开发了DQN(Deep Q-Network),这是深度强化学习领域的里程碑式作品。DQN的创新之处在于它无需人类预先标注游戏规则或物体类别,仅通过屏幕像素和游戏得分两个信号,就能让AI在Atari游戏中通过试错学习到超越人类玩家的策略。这项成果不仅证明了深度神经网络在复杂决策任务中的潜力,更为后续AlphaGo的成功奠定了方法论基础。
值得注意的是,Koray在DQN项目中的角色不仅仅是算法开发者,更是技术路线的坚定推动者。在《Nature》发表的论文中,他与Volodymyr Mnih、David Silver并列第一作者,显示了其在核心技术创新中的平等贡献。当时,Facebook的Yann LeCun曾试图高薪挖角Koray,但DeepMind联合创始人Mustafa Suleyman透露,Hassabis通过提前披露谷歌收购计划并赋予期权价值,成功留住了这位关键人才。这一插曲侧面印证了Koray在早期DeepMind技术版图中的不可替代性。
除了DQN,Koray还主导了WaveNet的研发。这项技术突破了传统语音合成的局限,直接对原始音频波形进行建模,生成的声音在自然度、呼吸感和语调细节上达到了前所未有的水平。WaveNet随后被广泛应用于Google Assistant、地图导航和云服务中,成为谷歌语音交互体验的核心支撑。从DQN到WaveNet,Koray展现了一种独特的能力:既能深入底层算法创新,又能敏锐捕捉技术落地的应用场景,这种“全栈式”的技术视野为他日后管理庞大的Gemini项目积累了宝贵经验。
驾驭千人团队的“救火队长”艺术
2023年,谷歌将DeepMind与Google Brain合并,旨在集中力量开发Gemini。然而,组织架构的物理合并并不等于化学融合。原DeepMind团队偏向长期科学研究,文化自由松散;而Google Brain团队更贴近产品工程,强调效率与规范。两支队伍在技术路线、资源分配甚至代码风格上都存在显著差异。Koray的任务就是在这两种文化之间搭建桥梁,确保千余名顶尖研究员和工程师朝着同一个目标发力。
据内部消息透露,Koray在Gemini项目中扮演了“不可或缺的救火队长”角色。他需要平衡研究员对模型性能的极致追求与产品部门对稳定接口的需求,同时还要应对管理层对算力成本和发布时间的严格约束。例如,在决定GPU集群分配时,他不仅要考虑哪个模型实验更具科学价值,还要评估其对搜索广告延迟或云客户SLA的影响。这种多维度的决策能力,使得他在Sergey Brin等高层遇到棘手问题时,成为首选的咨询对象。
2025年6月,谷歌专门设立“首席AI架构师”一职并由Koray担任,这在大公司中极为罕见,通常意味着“因人设岗”。这一任命标志着他的职责从单纯的模型研发扩展到整个谷歌AI产品生态的架构设计。他负责推动Gemini与搜索、办公套件、Android系统及云平台的深度集成,提升迭代效率。从伦敦搬至加州总部,也象征着他工作重心的转移:从关注科学突破转向关注商业变现和用户规模。
Koray的管理风格以务实低调著称。他不像某些明星CEO那样频繁出现在媒体聚光灯下,而是更多地在内部会议中解决具体的技术瓶颈和组织摩擦。英国皇家工程院授予他院士头衔时,特别强调了他兼具深厚技术知识、研究领导力以及管理大型研究组织的能力。这种评价精准地概括了他的职业特质:他不是那种只会在白板上画架构图的理论家,也不是只会盯着KPI的管理者,而是一个懂代码、懂算法、更懂人性的技术领导者。
逆风局下的挑战与破局之道
尽管Koray能力出众,但他接手的局面堪称“地狱难度”。首先面临的是严重的人才流失危机。Jeff Dean、Oriol Vinyals、Quoc Le、David Silver以及John Jumper等核心人物的离开,不仅带走了顶尖的技术智力,更削弱了谷歌AI的组织记忆和文化凝聚力。这些人的出走往往伴随着对大公司官僚主义和创新停滞的不满,Koray需要在剩余团队中重建信心,证明谷歌依然是AI创新的最佳土壤。
其次,Gemini产品的市场表现不及预期。Gemini 3.5 Pro的反复跳票,暴露出谷歌在超大模型训练和工程化部署上的瓶颈。在OpenAI不断推出新特性、Anthropic在企业级市场稳步扩张的背景下,谷歌的压力巨大。Koray必须解决模型能力、推理速度、成本控制和安全合规之间的多重矛盾。特别是在Agent(智能体)和编程辅助能力方面,谷歌急需补齐短板,以维持在开发者生态中的影响力。
此外,双层领导结构带来的潜在冲突也不容忽视。Hassabis作为董事长和首席科学家,依然掌握着AGI长期方向的定义权;而Koray负责短期产品执行。当长期科学研究需要消耗大量算力却短期无产出,或者产品需求迫使研究团队偏离既定路线时,谁拥有最终拍板权?这种张力如果处理不当,可能导致内部资源内耗。Koray需要与Hassabis建立高度默契的分工机制,确保战略一致性与执行灵活性的平衡。
面对Meta、字节跳动等竞争对手的激进投入,Koray的破局之道可能在于发挥谷歌独有的生态优势。不同于初创公司单点突破的策略,谷歌拥有海量的用户数据、完善的云基础设施和多元化的应用场景。Koray若能成功将Gemini的能力无缝注入到数十亿用户日常使用的Gmail、Docs、Maps等产品中,形成强大的网络效应和用户粘性,便能在竞争中构建起难以复制的护城河。这需要极强的跨部门协调能力和产品思维,而这正是Koray过往经历中所验证的核心优势。
结语:务实主义者的时代机遇
Koray Kavukcuoglu的上位,标志着谷歌AI进入了一个由“务实主义者”主导的新阶段。在这个阶段,科学的纯粹性让位于工程的实效性,长期的愿景让位于短期的交付。这并非是对科学精神的背离,而是在激烈的市场竞争中生存下来的必要妥协。对于Koray而言,这既是一场巨大的考验,也是一个千载难逢的历史机遇。
如果他能够成功整合残留的顶尖人才,解决Gemini的技术瓶颈,并将其转化为真正的商业竞争力,那么他将不仅仅是一个过渡期的管理者,而是谷歌AI历史上承前启后的关键人物。反之,如果无法在短期内拿出令人信服的产品成果,谷歌在AI领域的领先地位可能会进一步动摇。无论结果如何,Koray的故事都提醒我们,在人工智能这场长跑中,不仅需要仰望星空的梦想家,更需要那些能够在泥泞中开辟道路、在混乱中建立秩序的执行者。乱世出枭雄,Koray能否成为谷歌的天命之人,时间将给出答案。