SanDisk 技術長 Alper Ilkbahar 在投資者日上表示,在他們模擬研究執行 4900 億參數的 Qwen3 代理型工作負載時,4 顆 HBF GPU 的表現就能追平 8 顆 HBM GPU,這代表每顆 GPU 的效能直接翻了一倍。
在這次的模擬研究中,他們選用了一款跟目前市面上最強顯示卡規格相近的 GPU,每顆配備 192GB 的 HBM 記憶體。隨後又測試了另一個版本,將所有的 HBM 晶片更換為 HBF,這讓單顆 GPU 的記憶體容量大幅增加到 4TB 左右。
這次測試主要是模擬多輪對話的 AI 代理任務,像是工程師寫程式的開發環境。當 AI 代理開始寫程式並派發更多工作時,底層跑的是擁有 4900 億參數的大型語言模型 Qwen3。
為了比較兩套系統的表現,他們測量了 Token 的輸出量。首先,如果只用 HBM 系統,要跑這個任務最少得用上 8 顆 GPU。因為低於這個數量根本就塞不下模型,所以 8 顆是起跳的基本配置。
在模擬器上,這 8 顆 GPU 的輸出表現非常穩定。接著看 HBF 系統,結果發現單單 1 顆 HBF GPU 就能跑完這個任務。雖然效能當然比不上 8 顆 GPU 的組合,但如果考慮到最省錢的方案,只要 1 顆 GPU 就能把工作處理掉。
最後,當增加到 4 顆 HBF GPU 時,效能就已經能跟 8 顆 HBM GPU 平起平坐。也就是說,這套新方案讓每顆 GPU 的產出效能變成了原來的 2 倍。
-
HBF 這個話題從去年年初就開始吵這個話題,到現在終於看到官方釋出的初步實驗資料。我個人對 HBF 一開始是抱持懷疑態度的,畢竟要讓快閃記憶體跑出跟 DRAM 一樣的效能,這實在有點超出我以前的知識範疇,不過我現在已經沒在這塊領域深入研究了,或許很多事情都機會。
如果HBF真的能做成功,那 NAND 快閃記憶體的後續成長潛力,絕對是另一個非常值得關注的重點。
August 14, 2026 156 1

