晶片與半導體 · 本週 (發布日 8 月 31 日)
本篇出自 2026年9月1日 晨報
本報 8 月 31 日那期講過牛津大學那篇:高頻寬快閃記憶體每一疊裝得下的容量是現行高頻寬記憶體的 16 倍,但直接換上去會拖垮效能,因為快閃記憶體的長尾延遲會讓 GPU 的排程器空等。今天新的是第二個團隊、不同解法:華為、蘇黎世聯邦理工學院與華中科技大學共同發表 FLINT,同樣把快閃記憶體當成高頻寬記憶體旁邊的容量層來放模型權重,做法有三件——用硬體緩衝控制器把零碎讀取合併成連續大批、把快閃記憶體的維護動作整個搬出推論的關鍵路徑、把一般固態硬碟那套「什麼都能寫」的位址對照表換成一張只讀的精簡表(Semiconductor Engineering,08-31;論文原文 arXiv 2608.25062,2026 年 8 月)。兩篇論文擺在一起看: 兩天內兩個互不相干的團隊、兩種不同做法,指向同一個瓶頸診斷——推論現在卡的是記憶體裝得下多少,不是算得多快。⚠️ 兩篇都停在論文階段,沒有任何一篇公布真實推論負載下的延遲實測,那仍是這條線該等的訊號。
只留 email,隨時退訂。這是我們唯一想請你做的事。
9 月 3 日的 Daybreak for Frontline Defenders 公告承諾十億美元補貼防禦方取用其前沿資安能力,起於美國,目標六個月內消耗完;優先對象是水務與污水…
Broadcom 做客製 AI 加速器與網通晶片,是超大規模雲端業者自研晶片的主要設計夥伴,所以它的營收是「大廠不用 NVIDIA 的那一部分」的直接代理指標。9 月 2 日的官方…
代理編碼工具在企業端最大的採用障礙,一直是「我的原始碼與密鑰會不會離開我的網路」。Cursor 9 月 2 日推出自架機器:模型推論仍在雲端,但工具執行整個拉回客戶自己的機器,程式…
現價是每一百萬個輸入 token 0.75 美元、輸出 3.75 美元,而同一頁逐字寫著這是優惠價、2026 年 12 月 31 日到期,2027 年 1 月 1 日起改為 1.5…