详细调试信息 - getPostsByCategory:
当前 cat_name: 即時經濟
传入的 cat_slugs: %e5%8d%b3%e6%99%82%e7%b6%93%e6%bf%9f
当前页码: 1
is_lifetime: false
时间条件: 即時新聞 - 3個月以內
查询结果:
找到文章数: 2502
最大页数: 251
当前返回文章ID数: 10
文章IDs: 7634503, 7634512, 7634476, 7634458, 7634411, 7634380, 7634363, 7634337, 7634285, 7634271
第1页第一篇文章日期: 2026-09-22
第1页最后一篇文章日期: 2026-09-21

DeepSeek據報採用更多華為等國產晶片訓練模型 梁文鋒稱是最大押注、但必須成功

據美媒《The Information》引述消息報道,中國AI初創公司DeepSeek創辦人梁文鋒在一場閉門投資者會議上透露,希望採用更多國產晶片訓練模型,並預計華為最快第四季或明年首季可交付新一批AI晶片作訓練。

相信華為有望追上Nvidia

報道指出,梁文鋒向投資者表示採用華為或其他國產處理器訓練模型,是DeepSeek「最大的押注之一」,但強調這項工作「必須成功」。他相信,華為晶片僅需數年時間便有望追上Nvidia的水平,因此決定率先適配Nvidia壟斷體系以外的硬件。

正訓練一款2萬億參數模型

梁文鋒又透露,DeepSeek目前正訓練一款2萬億參數模型,規模已超過V4旗艦模型的1.4萬億參數,另計畫訓練一款8萬億參數模型。

對於有關2萬億參數的模型,市場預期為即將發布的DeepSeek V4.1 Pro,並可能於10月中旬至下旬發布。據內媒報道,訓練2萬億參數大模型需要50萬至60萬億詞元(Token),按照目前顯卡算力估算,Nvidia H100/H200晶片需要3萬張,B200則需要1.5萬張;若採用華為昇騰910C,需要6萬張,採用昇騰950系列則需3萬張,與H200所需數量相當。
 

---------------------------------------------

>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。

>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
點擊以下6大平台 接收加拿大新聞及生活資訊

延伸閱讀

延伸閱讀

新世界據報洽售尖沙咀凱悅酒店50%股權 新加坡華業集團或接手

中信里昂料AI供應緊張延至2030年 Agent應用加速算力消耗

騰訊被視為「中國版Muse」最具條件載體 股價曾升逾7% 同日發佈新AI圖像模型

Meta旗下AI代理Muse爆紅 極速登頂App Store 分析:有望成新增長點