晶片與半導體 · 今日 (發布日 8 月 24 日)
本篇出自 2026年8月25日 晨報
輝達昨天配合 Hot Chips 研討會發文,宣稱新一代 Vera Rubin NVL72 系統在代理式工作負載上,「每百萬瓦的吞吐量最高可達上一代 GB300 NVL72 的 30 倍」(NVIDIA,08-24)。⚠️ 這個數字本報不建議當新聞讀:廠商自報、寫的是「最高可達」、比較基準是自家上一代而非競品。真正新的是它拿什麼量:原文寫明用的是 SemiAnalysis 的 AgentX 工作負載,而 AgentX 正是本報 8 月 24 日那期的主線。半導體與 AI 基礎設施研究機構 SemiAnalysis 昨天才把它開放發布。一把第三方量尺公開的同一天,最大的受測者就把它寫進自家官方行銷語言,這說明它已經有產業地位。它未來的獨立性風險也從這裡開始。⚠️ 本報無法確認輝達跑的是不是與公開版相同的組態、是否經 SemiAnalysis 複核;「用了同一個名字」不等於「跑的是同一份考卷」。
只留 email,隨時退訂。這是我們唯一想請你做的事。
五家電子設計自動化與 AI 晶片設計工具廠商的產品負責人在一場閉門圓桌上說,過去一年客戶對 AI 代理人的討論已經從「無上限的預算」轉為「在工程師層級限制 token 數或金額」,…
9 月 9 日 OpenAI 發企業版發布稿,把這款模型的定位從「最聰明的模型」改寫成「每一塊錢做最多有用的事」,並首次公布 API 價目:每百萬個輸入 token 10 美元、輸…
OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 …
Meta 9 月 8 日發表 Muse:跑在每個使用者專屬的雲端虛擬機上,可以開瀏覽器、填表單、代表使用者議價,先在美國上線(Meta Newsroom,2026-09-08)。方…