輝達 RTX Pro Blackwell 登場:導入 GDDR7、MIG 與新一代 AI、光線追蹤技術

接續 Ampere 與 Ada Lovelace 架構後,輝達專業繪圖加速器產品線在今年導入 Blackwell 架構。輝達於 3 月舉行的 GTC 大會發表 RTX Pro Blackwell 系列,產品涵蓋資料中心、桌上型工作站與筆電工作站,主打加速運算、AI 推論、光線追蹤與類神經渲染等應用。

輝達表示,RTX Pro Blackwell 將服務 AI、高科技、工程、設計、資料科學、3D 建模與虛擬實境等專業工作流程。不過,產品實際效能仍會受到軟體支援、工作負載、系統散熱與電力配置等因素影響。

三類產品布局,桌上型工作站率先上市

RTX Pro Blackwell 系列分為資料中心 GPU、桌上型電腦工作站 GPU,以及筆電工作站 GPU。首波預計於 5 月上市的產品為桌上型工作站 GPU,包括 RTX Pro 6000 Blackwell Workstation Edition 與 RTX Pro 6000 Blackwell Max-Q Workstation Edition。

兩款 RTX Pro 6000 的主要差異在於熱設計功耗與散熱設計:Workstation Edition 的熱設計功耗為 600 瓦,採用雙風扇;Max-Q Workstation Edition 則為 300 瓦,採用單風扇。RTX Pro 5000 Blackwell、RTX Pro 4500 Blackwell 與 RTX Pro 4000 Blackwell 預計於夏季供貨,輝達目前已在網站公開相關細部規格。

資料中心產品 RTX Pro 6000 Blackwell Server Edition,輝達目前僅表示將很快推出,公開資訊以簡要規格為主。筆電工作站產品則包括 RTX Pro 5000、RTX Pro 4000、RTX Pro 3000、RTX Pro 2000、RTX Pro 1000 與 RTX Pro 500 Blackwell,預計於今年稍後推出。

Blackwell 架構帶來八項主要升級

RTX Pro Blackwell 系列的主要硬體與平台特色包括:

  • 更大規模的串流多處理器(Streaming Multiprocessor,SM)
  • 第五代 Tensor 核心
  • 第四代 RT 核心
  • 更大容量與更高速度的 GDDR7 記憶體
  • 第九代 NVENC 多媒體編碼器
  • 第六代 NVDEC 多媒體解碼器
  • PCIe 5.0 介面
  • DisplayPort 2.1 視訊連接埠與 GPU 多執行個體(MIG)支援

除了 MIG 外,其餘多數功能也已在今年 1 月推出的 GeForce RTX 50 系列中成為主打技術,但 RTX Pro Blackwell 將這些能力帶入專業繪圖與工作站產品線。

第五代 Tensor 核心支援 FP4、FP6 與 DLSS 4

在運算組態方面,RTX Pro Blackwell 搭配的串流多處理器吞吐量最高可提升至前代的 1.5 倍,並加入類神經著色器(neural shaders),可在可程式化著色器內整合 AI 技術,支援 AI 增強型繪圖處理應用。

Blackwell 架構的第五代 Tensor 核心,為 RTX Pro Blackwell 系列提供最高 4,000 TOPS 的 AI 運算效能。輝達指出,與上一代專業繪圖 GPU 相比,這些產品在大型語言模型處理方面可提供 3 倍效能。

在數值精度方面,產品延續對 FP16、BF16、TF32 與 INT8 的支援,並加入 FP4 與 FP6 處理能力,同時提供類似資料中心 GPU 的第二代 FP8 Transformer Engine。第五代 Tensor 核心也支援具備多畫格生成(Multi Frame Generation)功能的 DLSS 4,可用於 AI 驅動的繪圖處理、大型 AI 模型執行與相關應用的原型設計。

第四代 RT 核心強化複雜幾何與光線追蹤

RTX Pro Blackwell 的第四代 RT 核心導入輝達 RTX Mega Geometry 技術(RTXMG),目標是在光線追蹤場景中處理更多幾何細節與更複雜的物件關係。

輝達表示,與上一代專業繪圖 GPU 相比,RTX Pro Blackwell 在建立逼真圖像、具物理精確度的場景與複雜 3D 內容時,光線與三角形相交(ray-triangle intersection)處理效能可達 2 倍。若啟用 RTXMG,光線追蹤三角形(ray-traced triangles)的處理效能最高可提升至 100 倍。這些數字屬於輝達提供的比較結果,實際表現仍取決於應用程式與場景內容。

GDDR7 記憶體容量與頻寬同步增加

為應對 AI 與大規模圖形運算對高速、大容量記憶體的需求,RTX Pro Blackwell 系列改用 GDDR7,記憶體存取介面擴增至 512 位元。相較之下,Ampere 與 Ada Lovelace 架構專業繪圖 GPU 搭配 GDDR6X 記憶體,存取介面為 384 位元。

RTX Pro Blackwell 的記憶體頻寬最高可達 1,792 GB/s;Ampere 架構為 936 GB/s,Ada Lovelace 架構則為 1,008 GB/s。工作站與伺服器等級產品最高可配置 96 GB 記憶體,筆電等級產品最高為 24 GB;前代 Ampere 與 Ada Lovelace 專業繪圖 GPU 的最高容量為 48 GB。

更高的記憶體容量與頻寬,可讓產品處理規模更大、複雜度更高的資料集,包括大型 3D 與 AI 專案,以及大型虛擬實境應用。

PCIe 5.0 與 MIG 擴大工作站資源配置彈性

RTX Pro Blackwell 系列支援 PCIe 5.0,I/O 頻寬相較 PCIe 4.0 提升至 2 倍,有助於改善 GPU 與處理器、系統記憶體之間的資料傳輸。前代 Ampere 與 Ada Lovelace 專業繪圖 GPU 則支援 PCIe 4.0。

另一項重要變化是 GPU 多執行個體(MIG)由資料中心 GPU 下放至專業繪圖 GPU。過去 A100、A30、H100、H200、B200 與 GB200 等產品已支援 MIG,Blackwell 世代的 RTX Pro 6000 與 RTX Pro 500 也加入這項功能。

RTX Pro 6000 Blackwell Server Edition、RTX Pro 6000 Blackwell Workstation Edition 與 RTX Pro 6000 Blackwell Max-Q Workstation Edition,可分割為 2 個各配置 48 GB 記憶體的 GPU,或 4 個各配置 24 GB 記憶體的 GPU。RTX Pro 5000 Blackwell 則可分割為 2 個各配置 24 GB 記憶體的 GPU。

輝達表示,這些 MIG 執行個體彼此完全隔離,具備專屬記憶體、快取、運算核心與服務等級(QoS)。透過故障隔離機制,可降低不同工作負載之間的互相干擾,並以更彈性的方式分配運算資源。

DisplayPort 2.1 與影音編解碼能力更新

顯示輸出方面,RTX Pro Blackwell 支援 DisplayPort 2.1b,能處理 4K、480 Hz,以及 8K、165 Hz 等高解析度、高更新率顯示情境。輝達表示,增加的顯示頻寬可支援更流暢的多螢幕配置,並提供 HDR 與更高色彩深度,適用於影片編輯、3D 設計與網路直播等工作。

影片編碼方面,產品內建第九代 NVENC,新增 H.264 與 HEVC 的 4:2:2 色彩取樣編碼支援,可提升影片編碼速度與專業繪圖應用程式的畫質,並支援 HEVC 與 AV1 編碼。

第六代 NVDEC 解碼器則支援 H.264 與 HEVC 的 4:2:2 色彩取樣解碼。輝達指出,H.264 解碼吞吐量可提升 1 倍,應用情境包括高畫質影片播放、影片資料擷取,以及 AI 輔助影片編輯。

RTX Pro 6000 Blackwell 規格

項目規格
原廠Nvidia
建議售價廠商未提供
版本伺服器版、工作站版、Max-Q 工作站版
外形雙槽;伺服器版與 Max-Q 工作站版長 10.5 吋、高 4.4 吋;工作站版長 12 吋、高 5.4 吋
GPU 架構Blackwell
CUDA 處理核心24,064 個
Tensor 核心伺服器版 752 個,第五代 Tensor 核心
RT 核心伺服器版 188 個,第四代 RT 核心
記憶體96 GB GDDR7
記憶體頻寬伺服器版 1,597 GB/s;工作站版與 Max-Q 工作站版 1,792 GB/s
連接介面PCIe 5.0 x16
NVLink不支援
單精度運算效能伺服器版 117 TFLOPS;工作站版 125 TFLOPS;Max-Q 工作站版 110 TFLOPS
RT 核心效能伺服器版 354.5 TFLOPS;工作站版 380 TFLOPS;Max-Q 工作站版 333 TFLOPS
AI 運算效能(FP4)伺服器版 3.7 PFLOPS;工作站版 4,000 TOPS;Max-Q 工作站版 3,511 TOPS
視訊連接埠4 個 DisplayPort 2.1b
視訊處理引擎4 個第九代 NVENC、4 個第六代 NVDEC
MIG4 個 24 GB 記憶體執行個體,或 2 個 48 GB 記憶體執行個體
耗電量工作站版 600 瓦;Max-Q 工作站版 300 瓦
繪圖處理 APIShader Model 6.6、OpenGL 4.63、DirectX 12、Vulkan 1.3
運算處理 APICUDA 12.8、DirectCompute、OpenCL 3.0

目前輝達尚未公布 RTX Pro 6000 Blackwell 的建議售價。上述規格與供貨資訊以目前公開資料為準,後續可能因產品版本或市場規劃而調整。

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles