DeepSeek V4:首個針對非 NVIDIA 晶片深度客製化的大模型 —V4 架構選擇清楚顯示是為 non-NVIDIA accelerators 和 ASICs 設計,尤其是 Huawei Ascend—其他 AI 晶片/ASIC 軟體生態系遠不如 NVIDIA 成熟;把 NVIDIA-optimized 模型直接移植到 Ascend,效率大打折扣——能跑是一回事,便宜穩定地跑是另一回事 $NVDA ↓看空 中期 DeepSeek V4 首次在架構層面繞開 NVIDIA 生態(CUDA、FlashAttention、NVLink 等),是對 NVIDIA 推論生態壟斷地位的潛在挑戰 #風險 若非 NVIDIA 硬體上可低成本高效率跑大模型成為趨勢,NVIDIA 在推論端的 pricing power 將面臨壓力 #風險 AI算力 ↓看空 中期 大模型架構開始針對非 NVIDIA 晶片優化,長期可能拉低對 NVIDIA GPU 算力的依賴程度 #風險 半導體 中期 DeepSeek V4 客製化非 NVIDIA 硬體代表 AI 晶片生態系多元化加速,對整體半導體版圖影響待觀察;Huawei Ascend 受益方向明確,但完整結論需更多資料