晶片與半導體 · 今日 (發表日 9 月 8 日)
本篇出自 2026年9月9日 晨報
OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 1.5 到 1.9 倍,受測商用系統的端到端延遲是它的 1.7 到 3.6 倍,年底前開始部署,與輝達、超微的加速器並行(OpenAI,2026-09-08)。為什麼用每瓦而不是每顆晶片: 在電力已經是瓶頸的產業裡,每一瓦電能吐出多少 token,比單顆晶片跑多快更接近真正的成本指標。⚠️ 三個折扣要一起看:受測商用系統沒有具名,這個倍數因此沒有可比的對象;正規化用的是規格書上的標稱功率而不是實測功耗,這對實際耗電低於標稱的一方有利(這點原文自己寫了);全部數字都是自陳,沒有第三方對帳。原文只寫年底前開始部署、與輝達與超微的加速器並行,沒有說它會不會對外銷售。外購與自研是挑戰者的兩條路徑,今天各自出現一個讀數: 一條要付股權當入場費,另一條宣稱已有效能優勢,而後者只有一方在說。
只留 email,隨時退訂。這是我們唯一想請你做的事。
五家電子設計自動化與 AI 晶片設計工具廠商的產品負責人在一場閉門圓桌上說,過去一年客戶對 AI 代理人的討論已經從「無上限的預算」轉為「在工程師層級限制 token 數或金額」,…
9 月 9 日 OpenAI 發企業版發布稿,把這款模型的定位從「最聰明的模型」改寫成「每一塊錢做最多有用的事」,並首次公布 API 價目:每百萬個輸入 token 10 美元、輸…
Meta 9 月 8 日發表 Muse:跑在每個使用者專屬的雲端虛擬機上,可以開瀏覽器、填表單、代表使用者議價,先在美國上線(Meta Newsroom,2026-09-08)。方…
Arm 發布新一代行動運算平台 CSS for Mobile 2;CSS 是 Arm 把 CPU、GPU 與系統模組預先整合後授權給晶片廠的產品形式。這一代的 C2 Ultra C…