大神觀點
本篇出自 2026年8月8日 晨報
他把「可驗證」拆成三層並推出一個關於速度的結論(原文):第一層程式可驗證、驗證幾乎免費——遊戲、寫程式、數學、資安、晶片設計;第二層真實世界可驗證、受成本或時間所限——生醫、材料、能源、航太、機器人、農業,以及交易與天氣這類預測;第三層靠人類偏好驗證——寫作、設計、喜劇、說服。核心推論是:「真實世界驗證的時間界限性質,可能就是我們不會遇到快速起飛的原因。」
值得記的是他多走的那一步:把可驗證性從「先做什麼」推到「總共多快」——成本受限可以用錢解決,時間受限買不到;你買得到一百萬張 GPU,買不到「這批藥的三期試驗提早一年結束」。⚠️ 它會被什麼推翻,寫在前面: 三個「用錢換時間」的手段沒有被排除——同時跑一百個試驗、用電腦模擬取代濕實驗、用可快速量測的替代終點指標;這條要成立必須主張這些手段有天花板,而該主張目前零證據。他說的也是「可能」,而且「快速起飛」沒有定義:若指數週內,時間界限論很強;若指數年內,製藥 18 個月的驗證週期根本不構成煞車。同一串下面 Box 執行長 Aaron Levie 把這個框架搬進企業知識工作(原文,2026-08-02)——但那是引用他而發,不算第二個獨立來源。能拿走的一句: 判斷任何「AI 幾年內顛覆某產業」的說法時,先問那個產業在第幾層;若在第二層,再問「驗證一次要等多久」——那個等待時間就是產業變化速度的下限。
只留 email,隨時退訂。這是我們唯一想請你做的事。
Anthropic 7 月 24 日發布 Claude Opus 5,定位中型,官方自述定價約旗艦 Fable 5 的一半,也稱多數實務任務追平旗艦。(誠實說明:本報 7/27 期…
:今天的模型比半年前「更有企圖心」。這裡說的 agent,指能自主連續執行多步驟任務的 AI 系統。舊一代 agent 不斷把專案降級成試點,現在的模型急著真的把事做完;他把這歸因…
:多數人——包括會議室裡拍板的人——連最基本的「AI 丸」都沒吞(吞藥丸=接受現實的英文比喻):「他們不相信 AI 有朝一日能做到它現在已經在做的事」。他把落差釘在已實現能力上:認…
同一位 Gavin Baker 的另一筆帳,與上一則的 TPU 估計合看:同一個人,一筆低估、一筆美化,共同教訓是轉述會失真:方向能信,數字與「免費」要回原文。他多次引用的太空資料…