具名的行家判斷:誰說了什麼、憑什麼、我們同不同意——本報的差異化資產。
57 篇
Sebastian Raschka 是長期寫深度學習架構解說的技術作者,經營電子報《Ahead of AI》,與模型廠商沒有利害關係(Ahead of AI,2026-09-09)…
Evan Hubinger 是 Anthropic 對齊科學團隊的負責人;對齊是一個研究領域,目標是讓 AI 系統的行為符合人類意圖與價值。9 月 8 日他回應一名剛離職同事的長文…
對企業採購方來說,它影響的是「供應商對自己產品風險的內部評估」這一欄,而那一欄平常只能靠猜測。本報收的是「Hubinger 這樣說」,不是那個機率數字本身。 ⚠️ 那是他個人的主觀…
Zvi 9 月 7 日逐字寫:「Jakub Pachocki flat out says that no one is at a place where it would be r…
Box 執行長 Aaron Levie 9 月 6 日說,網際網路幾乎完全沒有為「每個人的個人 AI 代理人到處替他們執行任務」的未來做好準備,並引一個個案:訂位平台 Resy 封…
Aaron Levie 是雲端內容管理公司 Box 的共同創辦人暨執行長。8 月 20 日他就「AI 時代該做專家還是通才」表態,論證分三段:第一段承認拉平,「AI makes i…
Arvind Narayanan 是普林斯頓大學電腦科學教授、《AI Snake Oil》共同作者。他分兩則長文解釋文字浮水印的機制,補上這條線此前缺的那一環:「The water…
Marcus 是認知科學家、紐約大學榮譽教授。他 9 月 3 日對 Astra 寫下:「One really doesn't want more capability in con…
他長期經營 AI 週報、逐條追蹤前沿實驗室的發布與安全議題,對任何一家實驗室都無商業依存。對今日主線第 1 點那場爭議,他的判斷是「玩火也是我的讀法。房子還沒燒掉。」(@TheZv…
Tomasz Tunguz 長期以公開數據寫 SaaS 與 AI 市場分析。他 8 月 31 日那篇的結論一句話:在前沿,新的稀缺不是價格,是取用權。 他列的收據都點得開:Sale…
Simon Willison 是開源網站框架 Django 的共同作者,長期公開實測 AI 工具並逐項記錄。他花了一段時間摸 OpenAI 7 月 9 日發表的 ChatGPT W…
身份要先講,因為這條的分量幾乎全在她身上:Anima Anandkumar 是加州理工學院的講座教授(數學與電腦科學),曾任 NVIDIA 的 AI 研究總監,更早在 AWS 協助…
Martin Casado:同一個市占數字有八個互不排斥的解釋,別挑最順口的當結論。 ·
Drew Breunig 是資料策略與 AI 應用領域的獨立作者,長期寫模型能力與實務工程的取捨。他在〈Fable & The End of the Free Lunch〉裡寫道:…
Sara Hooker 是前 Cohere For AI 負責人——那是模型公司 Cohere 旗下的非營利研究實驗室,長期做開放權重模型與跨語言研究,她本人長期站在「開放研究」這…
就 Gary Marcus 所見,幾乎沒有人相信那個安全理由:這位認知科學家、長期的 AI 批評者 8 月 19 日發文,講的是 OpenAI 前一天宣布因安全理由暫停部分前沿訓練…
Zvi Mowshowitz 長年在他的電子報上逐節拆解各家 AI 實驗室的文件,對 Anthropic 的立場一向偏批判。他讀完今日主線第 2 點那份 186 頁報告後寫下:「一…
輝達創辦人暨執行長黃仁勳 8 月 17 日在公司官方部落格發表〈Securing the Infrastructure of Intelligence〉,用自問自答的形式解釋今日主…
Anthropic 執行長 Dario Amodei 8 月 16 日表態,駁回一個在業界流傳的歸因。有人主張 AI 公司公開談風險本身在製造恐慌、應該改做正向公關敘事。他的回答是…
8 月 13 日,HashiCorp 共同創辦人、開源終端機 Ghostty 作者 Mitchell Hashimoto 貼文說,他看到細線條、發光風格、字體不一致、大量等寬字的頁…
Dean Ball 是 AI 政策分析寫作者、前白宮科技政策辦公室幕僚。8 月 14 日他回應另一位前政府官員 Jon Schweppe 給那條規則取的名字——「the Dean …
Marius Hobbhahn 是 Apollo Research 共同創辦人暨執行長,也就是今日主線第 1 點裡那家受託紅隊。他報告了一個具體的載體切換:多個 agent 原本會…
8 月 10 日 Meta 創辦人發表的長文《The Future Is For Everyone》裡有一項具體提案,本報直讀官方網域原文取得:「前沿 AI 實驗室應該分享新模型的…
7 月 22 日,EleutherAI 執行董事 Stella Biderman 公開指控 OpenAI「拒絕告訴開放實驗室他們對 GPT-OSS 做了什麼,這是他們持續選擇讓世界…
Box 共同創辦人暨執行長 Aaron Levie 用它解釋編碼 agent 為何一枝獨秀:編碼的經濟價值「直接對應純數位資訊的產出」,而且「單次工作階段的任務量原則上可以無上限」…
Flask 與 Jinja 這兩套 Python 網頁框架的作者 Armin Ronacher 連兩天記錄同一種故障:密碼管理工具 1Password 的瀏覽器擴充 agent 驅…
白話一句:囚徒困境的前提是「單方退出會被懲罰」,而 AI 競賽最常見的辯護正是「我不做別人也會做,停下來只是把優勢讓給更不小心的人」。Irving 主張前提是反的:單方停下來會降低…
他在離職當天以本人帳號首度說明新公司的技術路線,這是各家媒體轉述裡完全沒有的一手口徑:「我們的總體作法是把實驗迴圈自動化。我們認為這個作法在許多不同的科學與工程領域都廣泛適用。我們…
他把「可驗證」拆成三層並推出一個關於速度的結論(原文):第一層程式可驗證、驗證幾乎免費——遊戲、寫程式、數學、資安、晶片設計;第二層真實世界可驗證、受成本或時間所限——生醫、材料、…
Anthropic 7 月 24 日發布 Claude Opus 5,定位中型,官方自述定價約旗艦 Fable 5 的一半,也稱多數實務任務追平旗艦。(誠實說明:本報 7/27 期…
:今天的模型比半年前「更有企圖心」。這裡說的 agent,指能自主連續執行多步驟任務的 AI 系統。舊一代 agent 不斷把專案降級成試點,現在的模型急著真的把事做完;他把這歸因…
:多數人——包括會議室裡拍板的人——連最基本的「AI 丸」都沒吞(吞藥丸=接受現實的英文比喻):「他們不相信 AI 有朝一日能做到它現在已經在做的事」。他把落差釘在已實現能力上:認…
同一位 Gavin Baker 的另一筆帳,與上一則的 TPU 估計合看:同一個人,一筆低估、一筆美化,共同教訓是轉述會失真:方向能信,數字與「免費」要回原文。他多次引用的太空資料…
AI 工程圈意見領袖、Latent Space 播客共同主持人 swyx 公開宣告:「每百萬 token 多少錢,大約去年就不再是相關的成本量測了;x 軸還沒換成每任務成本($/t…
Anthropic 強化學習研究者 Sholto Douglas 推文預測:約 2027 年,雙臂機器人將可靠到能在裝配線或倉配中心實際工作(他自己標注「I think?」的不確定…
Nathan Lambert 對 Opus 5 追平旗艦給出機制解釋:他認為關鍵是「更快的迭代速度+規模化強化學習(RL)」,而旗艦模型「反而還太大、還沒法同樣做 RL」。若這個解…
Dwarkesh Patel 是獨立科技訪談者與作者,其 AI 產業深度論述常被業界轉引。他 6 月的文章主張:每個要教給模型的技能,背後對應至少數百位人類專家寫示範與評分標準;專…
Thompson 是科技戰略電子報 Stratechery 的作者、產業判讀最受引用的分析者之一。在華府與華爾街同聲恐慌的一週,他的判斷反著走:中國開源模型的威脅並不新;前沿實驗室…
Mollick 是賓州大學 Wharton 商學院教授,企業界讀者最多的 AI 實用主義評論者。他以第一手實測給出 2026 下半年的判讀:要拿 AI 做真工作,實務選項只有 Ch…
AI 編碼新創 Poolside 的共同執行長 Kant 主張:對長時間的複雜任務,在模型與系統之間夾一層工具協定(如 MCP)沒有意義。MCP 是 Anthropic 主推、讓 …
AI2 研究員 Nathan Lambert 與實務者 Florian Brand 給出分層:最前沿是 Kimi(月之暗面)與智譜 GLM,緊追是 DeepSeek 與 Qwen,…
Google DeepMind 執行長 Demis Hassabis 在去年年終訪談(本報昨夜才取得逐字稿)正面回應「規模化撞牆」論:只有報酬遞減、沒有牆,而且遞減不是零與一:Ge…
同一場訪談裡他把 AI 泡沫拆層:「還沒真的開始做、一出閘就用數百億美元估值募資的種子輪」他猜撐不住;大型科技公司的估值則有實質業務撐。DeepMind 自己兩面不敗——自有 TP…
紐約大學名譽教授、知名 AI 懷疑論者 Gary Marcus 發文主張:中國模型能力已幾乎追平美國,而美國目前的圍堵成本主要落在自己人身上(garymarcus.substack…
跨資料中心訓練,是把一場模型訓練拆到相距數百公里的多個資料中心同時跑,用來解單一園區電力不夠的難題。他當時斷言這條路「至少 Microsoft 與 OpenAI 已經搞定」;給的證…
他逐份比對六家開放權重模型的技術報告,發現「可調推理力度」(讓使用者決定模型答題前想多久、想多深)的訓練配方已趨於同一套三段框架,正式從研究特性變成出廠標準(原文)。一個具體數字:…
他丟出兩層觀察(原文):第一層,把寫程式 agent 排程成「每週自動研究並改進自家品牌在 AI 回答裡的能見度」,是被低估、本該商品化卻還沒人做的機會:這叫 AEO (Answe…
他重申一個判斷:前沿開放模型會加速 AI 的擴散,同時壓縮高資本支出巨頭的估值想像,因為開放模型讓好處更早、更廣地到手,靠封閉模型收溢價的空間就變小(X / @natolamber…
兩條判斷(原文):一,只要錢繼續湧入,供給端就有動機把開放模型的發布期拉得比預期更長,近期不會整併——他點名 K3、GLM 5.2、Inkling、DeepSeek 新版同期扎堆是…
他給了一個「own your intelligence」的說法:此刻的持久優勢不是某個時點最強的模型,而是隨時間複利的回饋迴路——誰擁有「使用訊號回流、持續改進系統」的迴路,誰就擁…
他公開估算 Inkling 最後一哩強化學習的規模:約一千張 GB300、跑約一週、約 $5M——並自標這是「初步猜測」(估算)。這個數字的價值在量級不在精確:業界從不公開「訓一顆…
他放大一個主張:工程師提交程式碼修改的請求(PR)若因「沒用對框架、不合慣例」被人類審查員退回,是「自動化的失敗」——機械可判定的守門該交給工具,人類審查則該上移、聚焦在實質判斷(…
他自宣 Amp 平均變便宜約 50%「而且好很多」,主因是「大致上把(Anthropic 的)Opus 換成了(OpenAI 的)GPT-5.6」(@sqs,2026-07-11 …
Wix 是上市的網站架設軟體公司;去年它以 $80M 買下當時只有一個人的新創 Base44——做「vibe-coding」,也就是用白話描述需求、讓 AI 直接生成整個應用程式。…
Lambert 是開源模型領域最常被引用的分析者之一(前 HuggingFace、AI2 研究員)。他 2025 年 9 月的長文有一句銳利的觀察(原文,2025-09):同一個模…
前 OpenAI 安全研究負責人、現正創業的 Weng,讀完 35 篇論文寫成綜述(原文,2026-07-04;圈內迴響)。她的意思拆開來說:harness 就是「怎麼給模型工具、…
大會主辦人 swyx 前天現場論述(影片,2026-07-10):終結「一路變大」路線的不是能力天花板,是可用性經濟 — 最聰明的模型又慢又貴,而所有人共同的硬預算是時間;付得起無…
只留 email,隨時退訂。這是我們唯一想請你做的事。