產品與晶片動態:誰出了什麼、為什麼這代表方向變了。
97 篇
五家電子設計自動化與 AI 晶片設計工具廠商的產品負責人在一場閉門圓桌上說,過去一年客戶對 AI 代理人的討論已經從「無上限的預算」轉為「在工程師層級限制 token 數或金額」,…
9 月 9 日 OpenAI 發企業版發布稿,把這款模型的定位從「最聰明的模型」改寫成「每一塊錢做最多有用的事」,並首次公布 API 價目:每百萬個輸入 token 10 美元、輸…
OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 …
Meta 9 月 8 日發表 Muse:跑在每個使用者專屬的雲端虛擬機上,可以開瀏覽器、填表單、代表使用者議價,先在美國上線(Meta Newsroom,2026-09-08)。方…
Arm 發布新一代行動運算平台 CSS for Mobile 2;CSS 是 Arm 把 CPU、GPU 與系統模組預先整合後授權給晶片廠的產品形式。這一代的 C2 Ultra C…
AWS 官方週報 9 月 7 日寫,Anthropic 把 Fable 5.1 指定為一類在任何平台上都附帶額外資料保留、安全審查與存取政策的模型;在 AWS 上這代表 promp…
據轉述,消費級顯示卡價格再度上漲,成因是記憶體吃緊加上晶片廠把產能從消費級顯示卡移向 AI 加速器;華碩、技嘉等 9 月在中國調漲至多每張人民幣 500 元,約 72.5 美元,高…
近 48 小時內產品公司發出的新文章有 76 篇,其中 68 篇本報取得的只有標題、沒有正文,佔了今天全部待讀材料的四分之一;其餘 8 篇今天沒有讀完。本報寧可空著,也不拿沒讀過原…
9 月 3 日的 Daybreak for Frontline Defenders 公告承諾十億美元補貼防禦方取用其前沿資安能力,起於美國,目標六個月內消耗完;優先對象是水務與污水…
Broadcom 做客製 AI 加速器與網通晶片,是超大規模雲端業者自研晶片的主要設計夥伴,所以它的營收是「大廠不用 NVIDIA 的那一部分」的直接代理指標。9 月 2 日的官方…
代理編碼工具在企業端最大的採用障礙,一直是「我的原始碼與密鑰會不會離開我的網路」。Cursor 9 月 2 日推出自架機器:模型推論仍在雲端,但工具執行整個拉回客戶自己的機器,程式…
現價是每一百萬個輸入 token 0.75 美元、輸出 3.75 美元,而同一頁逐字寫著這是優惠價、2026 年 12 月 31 日到期,2027 年 1 月 1 日起改為 1.5…
比利時的 imec 是全球先進製程的共同研發中心,主要晶圓廠與設備商都是它的夥伴,路線圖常被當成產業的公版時間表。它 9 月 1 日的技術報告講 CFET:把 p 型與 n 型電晶…
聯發科與 NVIDIA 8 月 31 日宣布擴大合作:聯發科將採用 NVIDIA 的 NVLink Fusion 平台,讓客戶自研的 XPU 有一條預先驗證過的路,接進 NVIDI…
本報 8 月 31 日那期講過牛津大學那篇:高頻寬快閃記憶體每一疊裝得下的容量是現行高頻寬記憶體的 16 倍,但直接換上去會拖垮效能,因為快閃記憶體的長尾延遲會讓 GPU 的排程器…
這七則出自同一場 VMware Explore,主軸只有一個:推出 VMware Private AI Cloud,口號是「把模型帶到資料旁邊,不是把資料送到模型那邊」。實質變化三…
牛津大學的研究團隊發表論文:高頻寬快閃記憶體每一疊的容量是現行高頻寬記憶體的 16 倍、頻寬相當,看起來就是推論裝不下大模型的解答;但直接替換會嚴重拖垮效能,因為快閃記憶體的長尾延…
喬治亞理工學院與電子設計軟體商 Synopsys 發表論文,對象是 2 奈米製程的 6 電晶體 SRAM。SRAM 是貼在運算單元旁邊的高速小記憶體,也是晶片上最占面積的東西之一。…
今日主線第 1 點那份季度申報,第二個讀數落在集中度上。Marvell 是替雲端業者設計自研 AI 晶片、並做資料中心光互連的關鍵供應商——NVIDIA 最大的那幾家客戶「自己做晶…
占淨營收 10% 以上的客戶那張表上,單一經銷商從去年同期的 34% 升到 44%,最大的直接客戶則持平在 16%。經銷商層的集中度上升,意味著它與終端客戶之間多了一層,終端需求的…
本報 8 月 28 日那期在快訊講過,AWS 承諾 2027 到 2028 兩年再部署 200 萬顆 NVIDIA GPU。今天要補的是那份聯合公告的另外半邊:它不只是買卡。合作同…
NVIDIA 最新一季營收 962 億美元、年增 106%,資料中心分部 890 億美元,公司整體毛利率 75%(資料中心產業媒體 DCD,08-27)。財務長 Colette K…
輝達昨天宣布把 NVLink Fusion 擴充到一項叫 NVHBM 的新記憶體技術。NVLink Fusion 是輝達開放給合作夥伴的介面,讓對方自研的晶片能接上輝達的機櫃級平台…
Salesforce 昨天宣布與 Anthropic 擴大策略合作,名為 Claudeforce:首發是一個叫「Salesforce in Claude」的外掛,內含 37 個預先…
Google Cloud 昨天在 Gemini Enterprise 與其開發工具上推出一組給代理工作量身打造的計費與成本管控功能:每人席次訂閱可以和新的按用量付費混用,避免代理跑…
OpenAI 自研推論晶片 Jalapeño 交出第一份成績單,用的考卷是兩天前輝達也在用的那把第三方量尺。 ·
OpenAI 最新一整個模型系列進駐 AWS 的開發代理工具 Kiro——雙方給的賣點,正是「外殼決定成本」。 ·
輝達昨天配合 Hot Chips 研討會發文,宣稱新一代 Vera Rubin NVL72 系統在代理式工作負載上,「每百萬瓦的吞吐量最高可達上一代 GB300 NVL72 的 3…
Dan Nystedt 是亞洲半導體供應鏈記者、TriOrient 分析師,長期在 X 上轉述台灣中文財經媒體的供應鏈報導。他當天發了幾則轉述。其一:矽晶圓——半導體製造的起點,一…
阿里巴巴 2026 年第二季財報電話會上,執行長吳泳銘告訴分析師:公司會更依賴子公司平頭哥自研的晶片,用在自家的資料中心;是否對外銷售,原文沒有交代。他預期,隨著自研晶片的部署比例…
人不必再每一圈都進場:程式編輯器廠商 Cursor 8 月 19 日的更新(更新日誌,08-19)讓雲端 agent 訂閱一個事件源——盯著一個合併請求、守著一條 Slack 討論…
半導體分析機構 Moor Insights & Strategy 創辦人 Patrick Moorhead 8 月 18 日公開他跟至少十幾家晶片設計公司談過同一個題目後得到的一致…
專案管理軟體商 Asana 用 OpenAI 的 Codex 移除了一套已經沒人維護、擋住前端升級的舊測試框架。做法寫得很具體:從一段五句話的提示開始,最多四個編碼代理平行跑,每個…
AI 程式編輯器廠商 Cursor 8 月 17 日宣布 Origin:它自己的程式碼託管服務,即日起在所有付費方案上進入早期測試,首發功能是 repo、pull request、…
晶片線今天就是頭條,另一條晶片素材是傳言等級、已放在快訊第 2 則;本期無過去洞見,回顧欄的素材已經用完。
Simon Willison(見大神觀點欄)實測阿里巴巴新發布的 Qwen 3.8 27B(Apache 2 授權、開放權重、具視覺能力,降精度壓縮(量化)後約 17 GB,塞得進…
先進封裝是把 GPU 晶粒與高頻寬記憶體黏合的那道後段工序,近年 AI 晶片的產能限制不在前段晶圓製造,就卡在這裡。7 月中下旬三件事並排:台積電董事長公開歡迎競爭對手英特爾的封裝…
過去談超微的軟體生態,證據集中在大型推論框架;這兩週有兩個獨立來源指向另一個位置。7 月 23 日超微年度大會的端側段:下一代 Halo 開發平台將在極小機箱內提供 192GB 記…
8 月 13 日,Google 執行長 Sundar Pichai 親自發布 Gemini 3.7 Flash,距 3.6 Flash 只有三週,貼文說「導入價是 3.6 Flas…
8 月 13 日,日本 AI 公司 Sakana AI 共同創辦人暨執行長 David Ha(前 Google Brain 東京研究員)宣布 Sakana Chat 大改版:改由自…
8 月 11 日一則轉述中國媒體的供應鏈報導指出:長鑫存儲(CXMT,中國最大的 DRAM 製造商)的 17 奈米 DDR5 良率已超過九成、現貨供應充裕,但美系個人電腦品牌的態度…
8 月 11 日,法國模型商 Mistral 公布一組動作:區域端點正式推出,客戶可以指定推論跑在歐洲或美國,以符合資料落地與法規要求;新的優先層進入公開預覽,提供承諾服務等級與正…
OpenAI 在 8 月 11 日更新它的廣告說明頁,宣布 ChatGPT Ads 已在上述五個市場推出,並稱今年會繼續擴張。方向從哪轉到哪:這條線 2 月 9 日開始只是美國的登…
7 月 27 日,北京的 Moonshot AI 把 2.8 兆參數的 Kimi K3 權重放上 Hugging Face,檔案共 1.56TB,任何人都能下載;十天後的 8 月 …
8 月 3 日同一天:中國券商國海證券在世界人工智慧大會後的研究報告估 380 萬顆;一位長期追蹤中國模型與訓練細節的匿名分析者說他聽到的是 260 萬顆;另一位論者給的是 75 …
官方說明:不用在另一個工作階段重新解釋一次,你可以叫 Claude 去做;它送的是摘要,不是你的歷史或檔案,另一個階段會在任務中途接手(原文,2026-08-07)。值得注意的是,…
7 月 27 日,北京的 Moonshot AI 把 2.8 兆參數的 Kimi K3 權重放上 Hugging Face,檔案共 1.56TB,任何人都能下載。十天後的 8 月 …
路透 8 月 4 日報導川普政府正草擬禁止中國資料中心設備的規定(報導,2026-08-04)。光通訊分析師 Andrew Schmitt 當天指出的反制槓桿很具體:磷化銦晶圓出口…
阿里巴巴 Qwen 官方帳號 8 月 3 日發布 Qwen3.8-Max,首次公布官方 API 三段價格——輸入每百萬 token 2.0 美元、輸出 6.0 美元、隱式快取 0.…
本報 7/25 期報過半導體研究機構 SemiAnalysis 對 AMD 的改口,其中一條核心主張是:AI agent 自動寫、自動調 GPU 底層運算程式(kernel),正在…
Teortaxes 這批推文裡結構價值最高的一條:軟體側,中國模型架構收斂到「混合專家+寬專家平行」——混合專家(MoE)指每個字詞只喚醒少數「專家」子網路,省單卡算力、改吃記憶體…
同一位評論者主張中國先進製程的重點在擴散面——不只中芯國際(SMIC,中國最大晶圓代工廠),會有多家晶圓廠具備 N+3(中芯第三代 7 奈米級製程)(Teortaxes,07-20…
Teortaxes 就一則他自稱玩具級的概念驗證提出結構觀察:像「2030 年代做出 EUV(極紫外光曝光機,先進晶片製造的關鍵設備)」這類工程目標的時程,正隨 AI 進展被壓縮,…
股癌 4 月下旬講了一條當週對自己持股不利的訊息:Google 決定讓聯發科承接設計的 TPU(Google 自研 AI 晶片)走 Intel 的 EMIB 封裝(Intel 的先…
微軟今年 1 月發表新一代自研 AI 晶片 Maia 200,同批播客素材補了一層市場少講的脈絡:前一代 Maia 並沒有成功放量——佐證是敘事佔有率,滿街講 Google TPU…
同批素材另記:記憶體合約價漲了「大概 70–80% 以上」,連採購議價權最強的 Apple 都被拉價,但毛利指引仍守在 48–49%——靠三件事吸收:高階 iPhone 把記憶體容…
台灣散戶投資播客「股癌」主持人謝孟恭,是台灣半導體供應鏈的市場派觀察者,非業內一手。他在 2026-01-24 的節目裡,在自己看多、且自陳持有美光與台系 NAND 部位的前提下,…
同一節目 2026-01-24 那集記下當時台灣供應鏈側的說法(原集音檔,EP630):Google 自研 AI 晶片 TPU 的產品線裡,v7p 由 Google 與 Broad…
科技基金 Atreides 創辦人 Gavin Baker 在 2025 年中的訪談裡估:2027 年 Google 自研 AI 晶片 TPU 的規模約 300 億美元、其中付給設…
OpenAI 總裁 Greg Brockman 宣布 ChatGPT Work 第二輪促銷:8 月 21 日前註冊的 ChatGPT Enterprise 客戶,每位首次試用 Wo…
線上寫程式平台 Replit 執行長 Amjad Masad 回顧去年的 Lemkin 刪庫事件(一位知名創投直播用 AI 寫程式時整個資料庫被 AI 刪掉)並揭露產品後果:當時沒…
NVIDIA 把自家 Vera 伺服器 CPU 投入自家下一代晶片的設計流程:與兩大晶片設計軟體商 Cadence、Synopsys 的驗證工具實測最高 1.5 倍加速——「用自家…
AT&T 用微軟的 AI 開發平台 Foundry 代管 GPU 算力、搭配 AMD 晶片,訓練自家電信領域專用模型 OTel2.0,工作負載達兆級 token——大型電信商自建領…
AMD 下一代旗艦 AI 晶片 MI455X 是首款採台積電 2 奈米製程的資料中心晶片,封裝內邏輯矽 3,470 平方毫米為業界單封裝之最,12 堆疊 HBM4 記憶體共 432…
AI 雲服務商 CoreWeave 宣布為 Nvidia 下一代 Vera Rubin NVL72 機架部署液冷交換器,單機架交換容量 1.64 Pb/s,比氣冷方案高 100%(…
Anthropic(Claude 系列模型的開發商)發布新一代模型 Claude Opus 5(官方公告,07-24);企業資料雲平台 Snowflake 以發布夥伴身分同日在其 …
Salesforce 宣布獲美國退伍軍人事務部(VA)授予 16 億美元、三年期合約,部署其政府雲與 AI agent 產品線,串接跨部門資料與行政流程(Salesforce 官方…
與今日主線第 5 點同一篇文章:Rubin 對現役 Blackwell 的晶片級改動是張量核吞吐倍增、記憶體頻寬 2.8 倍(Nvidia 自報規格、未經第三方實測),且刻意讓既有…
這是 Intel 代工業務一筆對外客戶宣示,其中包含設計服務(X / @lipbutan1,07-22)。但製程節點、量產時程、量體全部未揭,Fortinet 側也未見對證。Int…
本報 7/22 期產品動態寫過:agent 能不能做到之後,下一題是用哪組模型做最便宜。今天 AI 程式編輯器 Cursor 發布 Cursor Router:自動分析每個請求、按…
Google 宣布為該計畫投入 4,000 萬美元的 AI 算力額度(Google DeepMind,07-22);AI 晶片新創 SambaNova 宣布加入其聯盟(SambaN…
台灣投資播客「股癌」(謝孟恭)今年 1 月的兩集提供市場端讀數:儲存廠 SanDisk 報價企業級 SSD 漲約五成、消費級漲超過 100%(Gooaye EP626,2026-0…
AI 程式編輯器公司 Cursor 自報:一組 agent 僅憑 SQLite(全世界最廣泛部署的資料庫軟體之一)的 835 頁官方手冊,將其重建為 Rust 語言複製品,通過 1…
Microsoft 將部署下一代 AMD Instinct 加速器與 EPYC 處理器,兩家公司宣布擴大長期戰略合作(AMD 投資人新聞,07-20)。放在脈絡裡讀:大型雲端服務商…
NVIDIA:藥廠 Bristol Myers Squibb 將在其下一代 Vera Rubin 平台上,建製藥業「最先進的 AI 工廠」(AI 工廠是 NVIDIA 對整套算力設…
官方部落格 07-17 的論點:agent 時代的模型不是訓練完就結束,上線後要隨環境變化持續補強訓練 (post-training),這種跑不停的迴圈正成為中心工作負載;因此在「…
昨天先上了模型比價平台 OpenRouter(2026/7/17 期第 4 點:Meta 的 Muse Spark 1.1 上架);今天是企業資料平台大廠 Databricks,宣…
寫程式工具 Cursor 07-17 更新:在 Slack 裡呼叫它時,它會先回一個工作計畫、讓你有機會提早改方向,才開始動工;支援一次跨多個程式庫的任務,途中需要動到別的庫會主動…
這是 Google 執行長 Pichai 的貼文原話(X / @sundarpichai,07-16);行銷語氣明顯、Intel 側零佐證、部署範圍與深度全都不明,本報收作待驗線索…
Google Cloud 07-16 宣布與 Parallel Web Systems 合作——一家專做「給 AI 用的搜尋基建」的新創——把它接進 Gemini Enterpri…
LangChain 執行長 Chase 同日宣布,協作知識庫工具 OpenWiki 採用開放知識格式 OKF(X / @hwchase17,07-16)。背景一句:現在每家 age…
SK Hynix 股價 7 月 14 日單日大漲 27%、市值破一兆美元,財經記者 Joe Weisenthal 點出背景:地緣政治下拿不到便宜的中國記憶體,美國 CPI 統計中的…
ASML 公布 2026 年第二季淨銷售 93 億歐元,執行長稱銷售強勁、正研究未來兩年增加 EUV(極紫外光刻)產能,同時披露與 Intel 的 Panther Lake 晶片協…
Arm 官方部落格昨日引 6 月 23 日的全球超算 TOP500 榜單:新科第一 LineShine 是首台持續雙精度算力破 2 exaflops 的系統,而且是不帶 GPU 加…
昨日發布 Jetson T3000 與 T2000 模組,把多模態機器人推理下放到量產價位帶;同日推出 Cosmos 3 Edge——40 億參數、可在裝置上跑的機器人世界模型,官…
執行長 Harrison Chase 官宣「正式投入 Slack 作為 agent 介面」,賣點是把 AI 帶到「團隊已經在的地方」、不逼用戶換新 app(X,07-15)。框架商…
Arm 原本的生意是授權晶片架構收權利金、自己不做晶片;5 月申報的股東信發表自研資料中心 CPU「AGI CPU」(Arm 官方命名),等於與自家授權客戶部分競爭,是商業模式的結…
1–7 月累計年增 +37.6%;月營收申報是台灣上市公司特有的高頻法定揭露,也是整條 AI 供應鏈最高頻的一手讀數(6-K)。同份申報的冷細節:對亞利桑那廠的背書保證餘額 NT$…
本週的新數字是:同一份 EV 592 裡,H100 的「現貨價」(隨租隨用的即期價格)同期只漲約 10%,遠低於主線第 2 點那個一年期合約指數的 +38%。以下是配著讀的解讀框架…
[商業][連動]:Amazon 雲端的多模型平台——企業用同一組介面就能接上 Anthropic、Meta 等多家 AI 模型,再接自家資料、加安全護欄、組裝成自動化流程,不必自己…
Epoch 從 1,604 條職缺讀出一個結構(6/24,同前出處):中國的 AI 推理在生產環境仍普遍跑在 Nvidia 上(用它的 CUDA、TensorRT-LLM 這套軟體…
這些巨頭自己設計 AI 晶片、想把「租 NVIDIA」換成「用自家的」,已是進行中的趨勢(還沒撼動 GPU 主導)。而今日主線第 3 點那個保底計畫,SemiAnalysis 點出…
[商業][連動]:讓企業用同一組介面接多家 AI 模型(Anthropic、Meta、Amazon 自家等)的平台,能接自家資料、加安全護欄、串成 agent,不用自己搭底層(20…
推理服務商 Featherless 共同創辦人 Eugene Cheah 的租賃市場一手快照(客座文,2024-10):H100 時租從短缺期的每小時 $8 崩到 $2,年降幅 ≥…
一手田野:自研 ML 框架 tinygrad 的 George Hotz(geohot)在訪談(2023-06-20)給了最直白的證詞 — AMD 的 RX 7900 XTX($9…
SemiAnalysis 在公開文(2026-06-18)逐項對帳:過去 6 個月它對 2026 年底北美超大規模自建產能的預測只動了 ~1%、託管(colocation)<5% …
只留 email,隨時退訂。這是我們唯一想請你做的事。