晶片與半導體 · 本季 (事件日 8 月 20 日)
本篇出自 2026年9月12日 晨報
推論晶片指的是只做「模型訓練完之後、真正拿去回答問題」那一段運算的客製晶片,放棄通用性換效率。8 月 20 日,一個帳號對這個賽道的新創 Etched 提出三句質疑:走高頻寬記憶體那條路贏不過繪圖處理器與張量處理器;走晶片內建靜態記憶體那條路贏不過 Groq 與 Cerebras;而「低電壓推論是唬爛,搬資料要能量,這是物理」(Bing Xu(X),2026-08-20)。⚠️ 這個帳號的身分本報沒有核過,這是本報第一次收錄它,不要因為他講得像內行就當內行。 真正承重的是本報手上既有的兩份材料,不是他。第三句站不住:搬資料要能量為真,但那是一個地板、不是一個常數,整個產業在做的正是把地板往下壓:另一家推論晶片商 d-Matrix 的 3D 堆疊記憶體測試晶片自稱最壞情況約每位元 0.4 皮焦耳,對比高頻寬記憶體的 3 到 4 皮焦耳,差一個量級(d-Matrix 官方部落格,2026-03-16;⚠️ 廠商第一方宣稱,未經第三方實測)。第二句反而被強化,而且強化的方向他可能沒算到:輝達在 2026 年 3 月的大會上揭露了整合 Groq 技術的新一代推論晶片,每顆 500 MB 靜態記憶體、FP8 每秒 1.2 千兆次浮點運算(More Than Moore,2026-03-16)。⇒ 靜態記憶體那條路的守方現在不只是 Groq,是輝達,新創走這條路的處境比他描述的更差。
只留 email,隨時退訂。這是我們唯一想請你做的事。
本報 9 月 9 日收下 Qualcomm 與 Amazon 那筆合作時,手上只有申報文件,講的全是錢,沒講用途,所以當時寫下「分不出這是 AWS 自研晶片線的供應商,還是第三條路…
CoreWeave 在 9 月 11 日的官方部落格上,開場第一句就寫「我花很多時間跟替這波建設出錢的投資人談」,接著主張只租硬體會把客戶留在自己處理軟體與維運的位置,而編排、可觀…
d-Matrix 是專做 AI 推論的晶片商,推論指的是模型訓練完之後、真正拿去回答問題的那一段運算。它宣布下一代的 Raptor 客製化加速器將採用輝達的 NVLink Fusi…
harness 指的是模型外面那層工作環境:管上下文、調工具、協調子任務、保存中間結果的那一整套,過去它是每家公司自己寫的膠水。OpenAI 推出 Agents API 公開測試版…