晶片與半導體 · 趨勢觀察
Epoch 從 1,604 條職缺讀出一個結構(6/24,同前出處):中國的 AI 推理在生產環境仍普遍跑在 Nvidia 上(用它的 CUDA、TensorRT-LLM 這套軟體),同時各家在招華為昇騰(Ascend)、寒武紀的相關人才;也有個別模型(GLM-Image,160 億參數)完全用國產晶片訓練。Epoch 的最佳猜測是:國產晶片「頻繁用於推理、罕用於預訓練」。拆開講 — 推理是「拿訓練好的模型去回答」,吃的算力相對輕;預訓練是「從頭把模型煉出來」,吃的算力最重。所以出口管制之下,國產替代是從下往上、先啃輕的那頭發生的。
驗證:這是 Epoch 讀職缺得出的推斷(推理端與圖上既有的「昇騰用於推理」線同向),不是廠商自白。現況(截至本期):這是 6 月下旬對職缺的一次讀取,國產晶片進展變動快,要盯的真正門檻是「預訓練」何時翻過去。
只留 email,隨時退訂。這是我們唯一想請你做的事。
五家電子設計自動化與 AI 晶片設計工具廠商的產品負責人在一場閉門圓桌上說,過去一年客戶對 AI 代理人的討論已經從「無上限的預算」轉為「在工程師層級限制 token 數或金額」,…
9 月 9 日 OpenAI 發企業版發布稿,把這款模型的定位從「最聰明的模型」改寫成「每一塊錢做最多有用的事」,並首次公布 API 價目:每百萬個輸入 token 10 美元、輸…
OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 …
Meta 9 月 8 日發表 Muse:跑在每個使用者專屬的雲端虛擬機上,可以開瀏覽器、填表單、代表使用者議價,先在美國上線(Meta Newsroom,2026-09-08)。方…