Key Takeaways: DeepSeek執行長在一場外洩的投資人電話會議中主張,AI程式碼生成技術可在12個月內瓦解Nvidia的軟體優勢。
Key Takeaways: DeepSeek執行長在一場外洩的投資人電話會議中主張,AI程式碼生成技術可在12個月內瓦解Nvidia的軟體優勢。

DeepSeek執行長在一場外洩的投資人電話會議中主張,AI程式碼生成技術可在12個月內瓦解Nvidia的軟體優勢。
DeepSeek執行長梁文鋒告訴投資人,AI驅動的程式碼生成技術以及TileLang編譯器,可在一年內消除Nvidia的CUDA軟體優勢,使華為晶片得以在中國資料中心取代這家美國公司的處理器。
根據Citrini Research分析師Jukan發布的會議摘要,梁文鋒表示:「AI驅動的程式碼生成與TileLang能迅速降低CUDA生態系的進入門檻。中國晶片的問題可望在一年內獲得解決。」
即使在這份外洩的發言中,也承認了Nvidia的領先地位。大約需要四顆華為晶片才能比肩一張Nvidia顯示卡,而華為在效能上約落後兩年。梁文鋒表示,DeepSeek已透過自家編譯器與基於TileLang的環境,降低對Nvidia軟體的依賴,而將該技術堆疊移植到華為晶片上,可讓950 SuperNode取代由Nvidia GB200與GB300處理的工作負載。
Nvidia將於8月26日發布第二季財報,營收指引為九百一十億美元——該數字已排除中國資料中心運算銷售。該公司上一季的資料中心營收達七百五十二億五千萬美元,較去年同期成長92%。Nvidia股價目前為本益比32倍(以過去12個月盈餘計算),在61位分析師中有58位給予買進評級。
差距依然巨大
超過十年以來,Nvidia的CUDA平台一直是GPU運算的主導軟體層,其上建構了數千個經過最佳化的函式庫與應用程式。相比之下,華為的昇騰(Ascend)晶片軟體支援有限——而梁文鋒聲稱TileLang能夠彌補這一差距。這位DeepSeek執行長表示,公司正與華為密切合作,目標是取得約一萬六千顆其AI晶片。
效能差距相當明顯。根據Nvidia公布的規格,H100的FP16效能達990 TFLOPS,而華為最接近的競爭產品910B,在可比工作量下估計約為250 TFLOPS。這大約4比1的比例與梁文鋒對差距的描述相符。Nvidia即將推出的Blackwell架構,基於台積電4奈米製程與客製化CoWoS封裝技術,預計在量產後將進一步拉大領先優勢。
梁文鋒論點的核心編譯器TileLang,是一個開源專案,可為不同硬體後端生成最佳化程式碼。如果它能將針對CUDA最佳化的工作負載轉譯為在華為昇騰架構上運行,這將消除中國晶片採用面臨的最大障礙:缺乏相容軟體。DeepSeek聲稱已在內部展示了這項能力。
8月26日值得關注的重點
Nvidia的財報電話會議將是執行長黃仁勳首次有機會正面回應CUDA生態遭侵蝕的說法。投資人將關注資料中心營收成長、Blackwell與Vera Rubin產品線的進展,以及毛利率的持續性。該公司對本季度的非GAAP毛利率指引為75%。
此影響遠不止於Nvidia。如果中國AI實驗室能以國產晶片取代Nvidia的處理器,這將降低對台積電先進封裝產能的需求,並可能為其他客戶釋出CoWoS供應量。超微(AMD)與英特爾(Intel)都在爭取AI工作負載市場,若華為成為這個超過二千億美元的AI晶片市場中可行的第三選項,競爭格局將重塑。
發布該會議摘要的Citrini Research分析師Jukan自稱「非常看空NVDA」。而華爾街的共識與此相距甚遠:58個買入評級、2個持有、1個賣出。多年競爭風險與一家仍以驚人速度複利增長的公司之間的拉鋸,正是Nvidia股東需要權衡的問題。
本文僅供資訊參考,不構成投資建議。