深圳AICon 9折优惠+AI前沿资讯推荐

Uber推出的“零增长技术栈”战略,核心目标是在业务规模持续扩张的同时,实现基础设施与AI成本的优化,通过将容量增长与业务需求解耦,大幅减少物理硬件的占用,同时降低传统资源扩容带来的额外开销。这一转型的核心在于系统性转向动态系统控制,确保即使内部软件复杂度不断提升,基础设施性能依然能够保持高效。
这一战略的核心支柱之一是针对Go运行时的系统性性能优化。团队发现,静态垃圾回收(GC)调优无法适配内存占用差异极大的服务——这类服务的内存使用范围从100MB到1GB不等。为此Uber开发了GOGCTunner动态解决方案,该工具可以自动调整GOGC参数,而GOGC值直接决定了垃圾回收周期触发的频率相对于堆增长速度的比例。通过直接集成cgroup内存限制并监控实时对象使用情况,这套工具能够动态调整运行时参数。目前该自动化方案已在30个关键任务服务中落地,成功回收了70000个CPU核心。不过这套方案也引入了动态控制循环,需要在堆大小(维持为实时对象大小的1.25倍)与严格的70%内存使用率阈值之间保持平衡,以此避免OOM(内存溢出)事件的发生。
除了基础设施优化,Uber还将生成式AI全面集成到软件开发生命周期中,以提升团队开发效率。其AI辅助开发架构包含多个层级:平台层以Michelangelo AI作为模型网关,上下文层通过MCP Gateway注入内部源代码,专用层部署Minion、Shepherd等后台Agent,审查层则借助uReview和Code Inbox等工具完成代码校验。当前已有92%的工程师每月都会使用这些AI辅助工具,其中31%的新代码由AI生成,Autocover工具每月可生成超过5000个单元测试。
不过快速普及这些AI工具也带来了显著的经济压力。自2024年以来,Uber的AI相关成本增长了六倍,由于基于Token的计费模式,团队预算快速耗尽,到2026年初,单个开发者的月度AI使用成本已经达到2000美元。
为解决这一问题,Uber从无限制使用模式转向严格的成本治理机制,将每位开发者的月度使用额度限制在1500美元以内。目前团队正在评估AI生成代码的实际效果,希望量化自动化产出效率与基础设施开销之间的直接关联。为了更精准地衡量效率,各团队正在从整体成本追踪转向更细粒度的指标体系。Uber不再仅依靠单位劳动收入和AI计算支出评估效率,而是提出了“净代码质量比”的衡量标准,即对比AI编写代码与人工编写代码在上线后出现热修复的频率。同时建立“每个功能的计算效率”指标,可以帮助工程负责人判断AI生成代码带来的额外开销——尤其是在考虑Autocover等工具生成的大量冗余测试之后——是否符合长期基础设施可持续发展的目标,确保基础设施优化能够与实际功能交付保持同步。


