晶片與半導體 · 今日
本篇出自 2026年7月18日 晨報
官方部落格 07-17 的論點:agent 時代的模型不是訓練完就結束,上線後要隨環境變化持續補強訓練 (post-training),這種跑不停的迴圈正成為中心工作負載;因此在「每百萬 token 多少錢」之上,還要算「每美元買到多少智能」,也就是同樣的錢,能把模型堆到多聰明(NVIDIA Blog,07-17)。給的數字全是自家的:開放權重模型 Nemotron 3 Ultra 在真實軟體修 bug 評測 SWE-bench Verified 自報 71.7%;Vera Rubin 平台自稱用 Blackwell 世代四分之一的 GPU 數就能訓練最大的模型,但「最大的模型」是哪個、四分之一比的基準是什麼,原文都沒給,這句目前無法驗證。驗證: 廠商自報、無第三方複現;但口徑本身值得記。本報昨日的 2026/7/17 期模型觀點才寫過 Databricks 的「每任務成本」實測,便宜的 token 不等於便宜的任務;賣晶片的現在把同一邏輯再抬一層。比價的尺從「單價」移向「結果」,採購的算法要跟著變;開獎點在第三方是否用同一把尺複現這套帳,例如 SWE-bench Verified 配上每百萬 token 成本,在那之前它仍是廠商敘事。
只留 email,隨時退訂。這是我們唯一想請你做的事。
五家電子設計自動化與 AI 晶片設計工具廠商的產品負責人在一場閉門圓桌上說,過去一年客戶對 AI 代理人的討論已經從「無上限的預算」轉為「在工程師層級限制 token 數或金額」,…
9 月 9 日 OpenAI 發企業版發布稿,把這款模型的定位從「最聰明的模型」改寫成「每一塊錢做最多有用的事」,並首次公布 API 價目:每百萬個輸入 token 10 美元、輸…
OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 …
Meta 9 月 8 日發表 Muse:跑在每個使用者專屬的雲端虛擬機上,可以開瀏覽器、填表單、代表使用者議價,先在美國上線(Meta Newsroom,2026-09-08)。方…