金吾财讯 | Uber Technologies(UBER)在接受Axios专访时披露,公司AI代理调用规模大幅攀升,但整体AI开支保持平稳,展示出企业在扩大AI工具渗透率的同时控制算力开销的实践路径。公司博客数据显示,自2月以来每周AI代理请求增长9.4倍,而AI总支出自4月起维持稳定,此前公司曾对外提示2026年AI预算存在超支压力。内部运行效率出现明显改善,在沿用原有AI模型的前提下,每千次请求成本较4月峰值下降近34%,单次会话成本对比6月高点下滑52%。当前AI代理已经覆盖Uber超过70%的代码变更提交工作,工程师每日执行的AI代理任务超3万个,使用AI工具的员工规模实现四倍以上增长。Uber采用多项技术策略压降AI开销,按照模型性能与价格做任务负载调度,把简单任务分流至低成本模型;设置单次会话40万代币上限,同时向工程师开放AI成本可视化能力;将快速缓存时长由五分钟延长至一小时,削减闲置阶段无效计算,开放权重模型实验同样为降本贡献助力。科技企业大规模落地AI过程中,算力成本是重要约束,Uber这套负载调度、缓存优化、大模型选型的组合方案,可为同类科技公司提供参考。
精彩评论