繁體
  • 简体中文
  • 繁體中文

熱門資訊> 正文

算力緊缺背景下 亞馬遜AWS要求工程師削減CPU資源浪費

2026-08-07 22:11

  據一位知情會議參與者透露,亞馬遜雲科技(AWS)管理層於5月與工程師召開會議,傳遞出一則嚴峻指令:為保障旗下熱門彈性雲服務器業務EC2未來能為全部客户提供充足算力,工程師必須想盡一切辦法節約資源。

  該知情人士表示,需節約的算力既包括通用中央處理器(CPU)服務器資源,也包含長期供不應求的AI專用芯片算力。過去數十年互聯網產業均依靠CPU芯片支撐運轉;而如今AWS內部不少工程師反映,申請CPU服務器算力用於研發的等待時間大幅拉長。

  有工程師稱,以往幾小時就能獲批的服務器算力,現在要等上好幾天,極易導致項目無法按期交付。這名工程師在AWS任職多年,從未遭遇如此漫長的資源排期。

  另有熟悉該內部規劃的人士透露,AWS已給各團隊設定今年下半年前完成算力壓降的期限。工程師正在關停軟件開發完成后閒置的EC2虛擬服務器(即雲實例),騰挪出這部分算力資源供給外部客户使用。

  今年席捲整個科技行業的算力荒,如今已蔓延至傳統通用算力領域。衆所周知,英偉達圖形處理器(GPU)等AI芯片需求暴漲,直接造成AI專用算力短缺;而受AI產業拉動,CPU服務器也陷入供給緊張。配套CPU使用的內存芯片產能不足、數據中心物理機櫃空間有限,進一步加劇了算力缺口。

  金融AI服務商埃倫迪爾實驗室聯合創始人兼董事謝靜(音譯)分析,越來越多員工藉助AI智能體開發軟件,企業CPU消耗量隨之激增。她接觸到的客户企業,員工人均IT開支直接翻倍——大量工作交由AI智能體處理,需要採購更多雲端算力,而這類任務普遍依賴CPU。

  即便在AI模型研發流程中,CPU也承擔關鍵工作:例如AI企業訓練模型前預處理數據時,需依靠CPU讀取文檔、圖片、視頻等原始素材。

  謝靜表示:「當下絕大多數模型開發、生成與運行任務,對CPU的需求量遠高於以往。」

英特爾首席執行官譚仲明在4月財報電話會上透露,當時AI推理(模型線上運行)場景中CPU與GPU算力配比為1:4;到7月,英特爾首席財務官大衞・津斯納稱二者配比已接近1:1,AMD、安謀(Arm)高管也給出類似判斷。

  AWS則否認自身運營策略發生變動,並在官方聲明中表示:「即便需求持續高漲,我們仍能滿足絕大多數內外部客户的算力需求。我們始終協同內部團隊保障其算力供給,同時督促團隊高效使用EC2資源,該管理方針從未改變。」

  亞馬遜稱,內部工程師優化資源的準則與面向外部客户的建議完全一致:例如關停閒置雲實例、切換適配自身業務負載的實例規格。若客户當前實例的算力未充分利用,可更換配置更低的機型。

  AWS給出明確優化標準:若某台EC2服務器連續四周CPU、內存平均使用率不足40%,建議客户降級更換更小規格實例。

  AWS配套提供自動化掃描工具,可自動識別利用率偏低的服務器。亞馬遜強調,即便當前內存芯片緊缺,面向內部員工的資源管控標準並未調整。

  近兩年來,平衡內部研發算力與外部客户算力供給,成為各大科技巨頭共同的難題。去年谷歌成立高管專項委員會,統籌分配谷歌雲、DeepMind人工智能實驗室、C端業務三大板塊的算力資源,但各方算力爭奪矛盾依舊突出。據報道,今夏谷歌頂尖AI研究員諾姆・沙澤爾便因算力資源受限、研發受阻離職。

  企業若能精細化管控算力資源,就能更快將閒置算力轉化為營收。微軟首席財務官艾米・胡德在上月最新財報電話會上表示,Azure雲服務業績增長,部分得益於團隊對CPU、GPU算力集群的高效調度優化。

  胡德稱:「本季度工程團隊在算力盤活上成效顯著;受供需失衡大環境影響,只要我們提升算力使用效率,新增的可用資源就能快速變現創收。」

  一名AWS行業諮詢顧問表示,客户通過合約鎖定的預留CPU算力暫未出現供給缺口,但近幾個月大批量申領AWS競價實例(廠商閒置富余算力,低價售賣、可提前兩分鍾回收資源)的難度明顯上升。

風險及免責提示:以上內容僅代表作者的個人立場和觀點,不代表華盛的任何立場,華盛亦無法證實上述內容的真實性、準確性和原創性。投資者在做出任何投資決定前,應結合自身情況,考慮投資產品的風險。必要時,請諮詢專業投資顧問的意見。華盛不提供任何投資建議,對此亦不做任何承諾和保證。