晶片與半導體 · 趨勢觀察
本篇出自 2026年7月13日 晨報
Epoch 從 1,604 條職缺讀出一個結構(6/24,同前出處):中國的 AI 推理在生產環境仍普遍跑在 Nvidia 上(用它的 CUDA、TensorRT-LLM 這套軟體),同時各家在招華為昇騰(Ascend)、寒武紀的相關人才;也有個別模型(GLM-Image,160 億參數)完全用國產晶片訓練。Epoch 的最佳猜測是:國產晶片「頻繁用於推理、罕用於預訓練」。拆開講 — 推理是「拿訓練好的模型去回答」,吃的算力相對輕;預訓練是「從頭把模型煉出來」,吃的算力最重。所以出口管制之下,國產替代是從下往上、先啃輕的那頭發生的。
驗證:這是 Epoch 讀職缺得出的推斷(推理端與圖上既有的「昇騰用於推理」線同向),不是廠商自白。現況(截至本期):這是 6 月下旬對職缺的一次讀取,國產晶片進展變動快,要盯的真正門檻是「預訓練」何時翻過去。
只留 email,隨時退訂。這是我們唯一想請你做的事。
NVIDIA 把自家 Vera 伺服器 CPU 投入自家下一代晶片的設計流程:與兩大晶片設計軟體商 Cadence、Synopsys 的驗證工具實測最高 1.5 倍加速——「用自家…
AT&T 用微軟的 AI 開發平台 Foundry 代管 GPU 算力、搭配 AMD 晶片,訓練自家電信領域專用模型 OTel2.0,工作負載達兆級 token——大型電信商自建領…
AMD 下一代旗艦 AI 晶片 MI455X 是首款採台積電 2 奈米製程的資料中心晶片,封裝內邏輯矽 3,470 平方毫米為業界單封裝之最,12 堆疊 HBM4 記憶體共 432…
AI 雲服務商 CoreWeave 宣布為 Nvidia 下一代 Vera Rubin NVL72 機架部署液冷交換器,單機架交換容量 1.64 Pb/s,比氣冷方案高 100%(…