Google Cloud正式推出搭載NVIDIA RTX Pro 6000 Blackwell Server Edition(BSE)的G4加速器最佳化虛擬機器,鎖定企業、內容創作者,以及需要GPU推論、模型微調、視覺運算與資料分析的工作負載。G4最大可配置8張RTX Pro 6000 Blackwell Server Edition,合計提供768 GB GDDR7記憶體,並透過強化的PCIe點對點資料路徑改善多GPU之間的資料交換效率。
G4的相關消息最早於2025年6月NVIDIA GTC 2025 Paris大會期間公布。Google Cloud當時表示,繼採用HGX B200的A4,以及搭載GB200 NVL72的A4X之後,G4將聚焦企業與內容創作者市場。Google Cloud在10月下半宣布G4正式上線,不過直到11月第一週,使用者才在Google Cloud管理主控臺看到NVIDIA RTX Pro 6000的GPU虛擬機器選項。Google Cloud說明,先前的允許清單限制尚未完全解除,因此服務供應仍未全面開放。


RTX Pro 6000 Blackwell帶來更高GPU規格
G4採用NVIDIA今年主打的RTX Pro 6000 Blackwell Server Edition。相較於Google Cloud現有搭載NVIDIA L4 GPU的G2虛擬機,G4所使用的RTX Pro 6000 Blackwell在規格上有明顯提升。
| 比較項目 | Google Cloud G2 | Google Cloud G4 | G4相對提升 |
|---|---|---|---|
| GPU架構 | NVIDIA Ada Lovelace | NVIDIA Blackwell | 新一代架構 |
| 運算效能 | 30.3 TFLOPS | 120 TFLOPS | 4倍 |
| GPU記憶體 | 24 GB | 96 GB | 4倍 |
| 記憶體頻寬 | 300 GB/s | 1,597 GB/s | 5.3倍 |
RTX Pro 6000 Blackwell Server Edition支援GPU多執行個體(MIG),並內建第五代RT Core。Google Cloud表示,相較前一代資料中心GPU,該GPU的光線追蹤效能可提升兩倍,適合即時著色、複雜視覺模擬與內容製作等工作負載。
透過PCIe點對點網路提升多GPU通訊

G4的主要特色不只在於單張GPU效能,也在於Google Cloud針對多GPU工作負載設計的資料傳輸架構。Google Cloud表示,G4實作強化的PCIe點對點資料路徑,並使用支援點對點通訊的軟體定義PCIe交織網路,改善All-Reduce等集合通訊操作。
這項設計主要針對需要跨GPU分割模型與交換資料的工作負載,包括支援NVIDIA集合通訊程式庫(NCCL)的系統。Google Cloud表示,與標準非點對點架構相比,相關多GPU集合通訊效能最高可提升至2.2倍。
- 4張GPU、位於單一非統一記憶體存取(NUMA)節點的G4虛擬機,集合通訊速度最高達2.04倍。
- 8張GPU、分布於2個NUMA節點的G4虛擬機,集合通訊速度最高達2.19倍。
- 將GPU點對點網路用於模型服務的張量平行處理時,吞吐量可提升168%,詞元間延遲(inter-token latency)可降低41%。
這些數據由Google Cloud針對特定組態與工作負載公布,實際效能仍會受到模型架構、通訊模式、資料分割方式與軟體設定影響。



最多8張GPU,搭配AMD EPYC與Titanium
處理器方面,G4採用AMD EPYC 9005系列處理器,代號為Turin,最大可配置384顆虛擬處理器與1.4 TB DDR5記憶體。最高階的8張GPU組態,等於每張GPU搭配48顆虛擬處理器,可用於執行嵌入式AI模型的預先運算,並由CPU協助調度模擬與資料處理工作。
G4同時沿用Google Cloud的Titanium基礎架構卸載平臺,提供專屬網路處理能力,最高網路連線頻寬達400 Gbps,為G2的4倍。對於需要大量資料輸入輸出、分散式推論與多GPU同步的應用,網路與主機端資料傳輸能力也是整體效能的重要因素。

涵蓋GKE、Vertex AI與Dataproc
Google Cloud表示,G4可與旗下多項雲端服務整合。Google Kubernetes Engine(GKE)可選用G4虛擬機,並透過自動輔助操作功能Autopilot擴展符合條件的GKE叢集。使用者也能配置具備橫向擴展能力的GKE Inference Gateway,管理AI模型流量與多個模型副本。
以Llama-3.1-70B為例,Google Cloud表示,使用雙GPU組態的G4虛擬機執行模型副本時,吞吐量可提升66%。搭配GKE Inference Gateway後,系統可管理多個副本並進行自動擴展,以因應不同區域的使用需求。

此外,Vertex AI可使用G4執行AI推論與訓練,Dataproc則能利用G4加速大型Spark與Hadoop工作負載。Google Cloud也預告,無伺服器容器執行服務Cloud Run將很快提供NVIDIA RTX Pro 6000 GPU選項,讓使用者能以更彈性的方式使用這類GPU運算資源。
G4組態與價格
Google Cloud G4目前提供g4-standard-48、g4-standard-96、g4-standard-192與g4-standard-384等組態,分別對應1、2、4與8張NVIDIA RTX Pro 6000 Blackwell Server Edition GPU。最高階組態提供384顆虛擬處理器、1,440 GiB記憶體、12,000 GiB本機儲存空間,以及400 Gbps網路頻寬。
在asia-southeast1-b區域,搭載1張GPU的g4-standard-48每月預估價格為3,944.01美元。G4的實際供應狀態與價格可能依區域、配額與服務政策而變動。





