DeepSeek據報採用更多華為等國產晶片訓練模型 梁文鋒稱是最大押注、但必須成功

更新時間:16:25 2026-09-22 HKT
發佈時間:16:25 2026-09-22 HKT

據美媒《The Information》引述消息報道,中國AI初創公司DeepSeek創辦人梁文鋒在一場閉門投資者會議上透露,希望採用更多國產晶片訓練模型,並預計華為最快第四季或明年首季可交付新一批AI晶片作訓練。

相信華為有望追上Nvidia

報道指出,梁文鋒向投資者表示採用華為或其他國產處理器訓練模型,是DeepSeek「最大的押注之一」,但強調這項工作「必須成功」。他相信,華為晶片僅需數年時間便有望追上Nvidia的水平,因此決定率先適配Nvidia壟斷體系以外的硬件。

正訓練一款2萬億參數模型

梁文鋒又透露,DeepSeek目前正訓練一款2萬億參數模型,規模已超過V4旗艦模型的1.4萬億參數,另計畫訓練一款8萬億參數模型。

對於有關2萬億參數的模型,市場預期為即將發布的DeepSeek V4.1 Pro,並可能於10月中旬至下旬發布。據內媒報道,訓練2萬億參數大模型需要50萬至60萬億詞元(Token),按照目前顯卡算力估算,Nvidia H100/H200晶片需要3萬張,B200則需要1.5萬張;若採用華為昇騰910C,需要6萬張,採用昇騰950系列則需3萬張,與H200所需數量相當。