華為表示,中國本土 AI 算力需求已大幅超出其供給能力,公司正加速兩款原定 2027 年推出的 Ascend 晶片時程,並規劃可串聯多達 100 萬顆處理器的系統,意在正面抗衡 Nvidia(輝達)。
重點摘要
- 華為坦言無法生產足夠的 AI 運算設備滿足中國市場需求,並正大幅壓縮多數海外出貨。
- Ascend 960DT 預計將在 2027 年第一季問世,比原訂時程提早三季。
- 華為 Peerium 架構鎖定將最多 100 萬顆處理器整合為單一大型運算系統。
Ascend 晶片路線圖加速
路透社於 9 月 17 日報導指稱,華為目前無法供應足量 AI 運算設備給中國客戶,被迫對海外市場實施配給,同時擴大並前移 Ascend 處理器產品路線圖,以確保「國內優先」。
輪值董事長 徐直軍指出,Ascend 950DT 的測試結果相當亮眼,華為已與多家中國大模型開發團隊洽談,最快明年就能在相關系統上展開訓練。不過,他並未提供數據佐證其另一項說法──Ascend 在中國的市占率已超越輝達。
另一位輪值董事長 汪濤則表示,Ascend 960DT 預計在 2027 年第一季完成準備,比原計畫提前三個季度;而 960PR 則將在第三季推出,同樣較原定時程提早一季。
延伸閱讀:iPhone Duo 對決 Galaxy Z Fold 8:選擇蘋果摺疊機的五大理由
正面競逐輝達
在單顆中國晶片性能與數量受限的情況下,華為嘗試透過大規模處理器互聯,提升整體 AI 訓練效率。其新一代 Peerium 架構設計目標,是將多達 100 萬顆處理器串接為同一運算系統;同時,一個 Ascend 960「超級節點」(supernode)可整合 4,096 顆晶片,再由多個超級節點擴充為更大的叢集。
這個策略對中國而言至關重要。中國仍面臨無法取得輝達最先進處理器及關鍵半導體製造設備的出口管制,而華為自 2019 年起也持續受到美國貿易限制。徐直軍強調,「晶片全面自給自足」是華為的長期方向。
華為指出,目前全球部分最大規模的大型語言模型訓練,所需的晶片數量已普遍來到約 10 萬顆等級,其中機器之間通訊所耗費的時間,可能占訓練時間逾四成。若能加快互聯速度,有望大幅減少這項瓶頸。不過,輝達仍仰賴其廣泛應用的 CUDA 軟體平台,在 AI 應用開發與部署上保持明顯優勢。
華為的 AI 基礎設施布局已經展開一段時間。公司表示,目前已部署逾 1,000 套 Ascend 910C 系統,Ascend 950 系統已進入商用階段,並支援超過 40 個直接在其平台上完成訓練的 AI 模型。

