金吾財訊 | Uber Technologies(UBER)在接受Axios專訪時披露,公司AI代理調用規模大幅攀升,但整體AI開支保持平穩,展示出企業在擴大AI工具滲透率的同時控制算力開銷的實踐路徑。公司博客數據顯示,自2月以來每周AI代理請求增長9.4倍,而AI總支出自4月起維持穩定,此前公司曾對外提示2026年AI預算存在超支壓力。內部運行效率出現明顯改善,在沿用原有AI模型的前提下,每千次請求成本較4月峯值下降近34%,單次會話成本對比6月高點下滑52%。當前AI代理已經覆蓋Uber超過70%的代碼變更提交工作,工程師每日執行的AI代理任務超3萬個,使用AI工具的員工規模實現四倍以上增長。Uber採用多項技術策略壓降AI開銷,按照模型性能與價格做任務負載調度,把簡單任務分流至低成本模型;設定單次會話40萬代幣上限,同時向工程師開放AI成本可視化能力;將快速緩存時長由五分鐘延長至一小時,削減閒置階段無效計算,開放權重模型實驗同樣為降本貢獻助力。科技企業大規模落地AI過程中,算力成本是重要約束,Uber這套負載調度、緩存優化、大模型選型的組合方案,可為同類科技公司提供參考。