晶片與半導體 · 今日 (發布日 9 月 10 日)
本篇出自 2026年9月11日 晨報
d-Matrix 是專做 AI 推論的晶片商,推論指的是模型訓練完之後、真正拿去回答問題的那一段運算。它宣布下一代的 Raptor 客製化加速器將採用輝達的 NVLink Fusion,把自家晶片直接接進輝達的機櫃與網路架構(輝達部落格,2026-09-10)。NVLink Fusion 是輝達開放給別家晶片的高頻寬連接介面,讓非輝達的處理器也能插進輝達那套已經大量部署、有供應鏈與液冷配套的標準機櫃。共同創辦人暨執行長 Sid Sheth 給的理由逐字是:推論需求正在暴增,但資本、時間與能源都有限。為什麼這一則值得看: 自研客製化加速器一直被講成「擺脫對輝達的依賴」那條路,而這一則顯示,這條路的最後一哩正在接回輝達的機櫃與網路標準;能省掉的是設計,省不掉的是部署。⚠️ 這是輝達自家部落格的公告,沒有第三方讀數,沒有出貨時程或價格,也沒有點名任何一家已採用的客戶,本報只用方向,不用任何量級推論。
只留 email,隨時退訂。這是我們唯一想請你做的事。
本報 9 月 9 日收下 Qualcomm 與 Amazon 那筆合作時,手上只有申報文件,講的全是錢,沒講用途,所以當時寫下「分不出這是 AWS 自研晶片線的供應商,還是第三條路…
推論晶片指的是只做「模型訓練完之後、真正拿去回答問題」那一段運算的客製晶片,放棄通用性換效率。8 月 20 日,一個帳號對這個賽道的新創 Etched 提出三句質疑:走高頻寬記憶體…
CoreWeave 在 9 月 11 日的官方部落格上,開場第一句就寫「我花很多時間跟替這波建設出錢的投資人談」,接著主張只租硬體會把客戶留在自己處理軟體與維運的位置,而編排、可觀…
harness 指的是模型外面那層工作環境:管上下文、調工具、協調子任務、保存中間結果的那一整套,過去它是每家公司自己寫的膠水。OpenAI 推出 Agents API 公開測試版…