SecondSource從一手資料重建判斷
晨報 · 2026年7月11日

AI 賣不進企業的原因多了第三個:「我敢不敢把資料給你」

本期素材:研究系統 2026-07-11 日報。當期事件出自 2026-07-09 的 20VC 圓桌與 07-10 的 AI Engineer 現場;另有 2024 檔案回填與 2023 論文原文核對,均標原發時間。本週有新具名觀點(swyx,07-10)。

本報不是新聞摘要:我們從每天的 AI 資訊流裡捕捉真正重要的洞見與值得長期追蹤的行家判斷,並交代每一條是怎麼驗證的 — 重點永遠是「哪條判斷變硬了、誰說得準」,不是今天發生了什麼。

本批來源盤點:過去 24 小時例行抓取零失敗;夜間讀完 32 篇/集(播客圓桌、電子報、X、部落格 — 單位為篇或集,類別不互比),白天再讀 5 篇 2024 年檔案 — 共 37 篇,夠格進正文的當期事件只有 3 條加 3 組傳言,沒新料的直接濾掉(=幫你省的時間)。持續追蹤 529 人(X 304、播客 90、論文作者 48、部落格 48、電子報 46、財報 26 等);無一次性新增。回顧素材不計入本批。

今日主線

1. [本週] Palantir 執行長 Karp 上 CNBC 點破企業客戶的兩大疑慮 — 同週的 HubSpot 事件替他作了證。2026-07-09 的 20VC 圓桌(影片)轉述 Alex Karp 被瘋傳的 CNBC 訪談:大企業對前沿模型商(點名 Anthropic、OpenAI)的懷疑「史上最高」— 花的錢換到什麼,以及「我把資料都給他們,他們是不是拿去訓練、學我的生意、再賣給所有人?」同週 HubSpot 想把客戶的業務開發資料匯集共享給其他客戶,客戶炸鍋,一週內撤回(同場轉述)。

驗證:Karp 是利益方 — Palantir 賣的正是「這些人不能信」的解方,當天股價 +9%(圓桌口述,單源)— 他的話打折聽;但 HubSpot 撤回是獨立事件,恐懼有現實觸發點。圓桌另指控模型商就訓練資料來源「說謊」— 只此一源,先看方向。

判斷更新:企業採用 AI 的障礙,本報原追蹤兩軸 — 模型可靠性、內部流程改造;今天加開第三軸「資料/智財信任」,它會把需求推向「資料留自己手上、不綁死單一供應商」。

2. [本週] 微軟把 6,000 名工程師派進客戶辦公室 — 賣 AI 的方式,倒退回 30 年前 IBM 賣服務的樣子。同場圓桌(2026-07-09,影片)轉述:Microsoft 宣布投入 25 億美元、6,000 人駐場工程計畫,把工程師嵌進企業客戶端,明著回應「MIT 稱 95% 企業 AI 試點沒有可量測損益影響」;Amazon 早兩天同向。圓桌讀法:OpenAI/Anthropic 是「產品公司到骨子裡」,企業導入需要中間服務層,微軟正接演 IBM/HP 當年服務部門的角色 —「每家科技公司不是倒閉,就是活得夠久、變成下一代的 IBM」;代價是毛利遠不如賣模型。

驗證:25 億、6,000 人、MIT 的 95% 全是 VC 口頭轉述、只此一源 — 數字先參考;一手公告尚未取得,取得後以追蹤更新補發。

判斷更新:「企業採用卡在哪」正式成三方對撞 — 圓桌押「流程改造+駐場人才不足」;對撞本報既有的 Sarah Guo 判斷(2024 年末,Colossus 訪談:瓶頸是模型可靠性,不是流程);再加第 1 條的資料信任軸。三派更可能分場景並存,但哪層主導,決定服務層、評測層、私有部署層誰吃到錢。開獎點:駐場計畫一年後的續約率、Anthropic 營收爬坡斜率。

3. [本週] 一天冒出三組公司傳言,本報一條都沒當事實收。同出 07-09/07-10 材料流(20VC 圓桌):(a) DeepSeek 開始自研晶片、Anthropic 與 Samsung 洽談自研;(b) Nvidia 採「先用算力後付款」式收入認列、「前三大客戶集中度 80% 降到 50%」;(c) OpenAI 讓美國政府持股 5%(轉述者自承沒讀過原始來源)。三組全是單一圓桌口頭轉述,查證前不進本報任何判斷。

驗證:這條的內容就是驗證方式 — (b) 的集中度可對 Nvidia 提交證管會的季度申報直接核對,已排入查證;其餘兩組等第二獨立來源。在別處看到這三組說法,記得它們還停在「單一轉述、未驗證」。

4. [證據更新] OpenAI「紅色警報」事件今天重核:被超車的是 GPT-5.1,不是流傳的「GPT-5」。事件本身(2025-12-02,Altman 內部信示警競爭、暫緩廣告與購物助理以聚焦 ChatGPT)當時由 Fortune、Forbes 等多家美媒同日報導,本報 7 月初已多源確認;今天是口徑精修 — 流傳版說「Gemini 3 與 Claude 超越了 GPT-5」,逐字回核:Gemini 3(2025-11-18)評測對標的是 GPT-5.1;Anthropic 官方原話只稱 Opus 4.5(2025-11-24)是「世界最佳的寫程式、代理與電腦操作模型」(官方頁,2025-11,今日逐字核對命中)。

驗證:事件層多源;「超越誰」在轉述鏈裡失真了一級 — 這正是本報堅持回到官方原文的原因。附帶流傳的「戰場轉向每瓦效能、Nvidia 護城河動搖」推論仍是分析師詮釋、無一手可核,不採信不否定(私版另有細節)。

5. [趨勢觀察] 「錢該花在哪」的三條 2024 年答案,今天一起列入本報正式追蹤判斷。(2024 檔案,今日完成跨來源核對)互不相識的一線從業者分頭講出,2026 年回看全數兌現:

(一)「用檢索還是微調」是假辯論 — 檢索(RAG)管「知道什麼」,把事實在提問當下釘進上下文;微調管「怎麼表現」,像幹細胞分化成特定細胞 — 意即改行為模式,不是灌知識;要灌知識,用檢索。Gradient 的 Mark Huang(2024-05-30)與 Brightwave 的 Mike Conover(2024-06-11),同期各自講出同一套。

(二)程式碼是 agent 的通用介面 — 用程式包住模型換可靠性(流程寫進程式,模型只管語意),讓模型寫程式換行動空間(與其列 128 個工具,不如讓它自造)。Microsoft 的 Sam Schillace(2024-03)講前者,Imbue 與 Databricks 同場講後者(2024-06)。

(三)工具介面佔 agent 成敗的九成 — ReAct 與 SWE-agent 作者 Shunyu Yao(時任 OpenAI)說:把工具介面做得好用又可靠,大概就佔了成敗的九成,Devin 的突破也在介面、不在規劃(2024-09-27)。

驗證:六個獨立原點、互不引用、同年收斂;第(一)條打立場折扣 — 兩位表述者都賣這套系統。事後印證:「讓模型寫程式執行」型 agent 已成主流,微調灌知識被公認是反模式。

判斷更新:這是一份買方清單 — 評 agent 產品先問:行為邊界在哪、程式執行面多大怎麼設防、工具介面誰做的;付訓練費前先問:要行為改變還是知識注入。

過去洞見

能力不再是模型的固定屬性,而是「你願意燒多少算力」的函數 — 它同時改寫評估、安全、失控三個問題。OpenAI 推理研究負責人 Noam Brown 的命題(No Priors,2026-06-26):鷹架搭得當,模型可在單一問題上思考數週不停滯 — 同一個模型,給 $10 和給 $10 萬的算力,能力天差地別。後果:(1)不控算力預算的「A 比 B 強」是壞比較,單一分數排行榜失去意義;(2)安全評測若用固定預算測危險能力,而該能力隨預算繼續上升,測出來的「安全」是假的;(3)不會有一夜失控 — 最強能力要用真實時間換。量測錨:METR 縱向研究(arXiv,2025-03)— 模型能自主完成的任務長度約每 7 個月翻倍,但發表時 50% 成功率的上限僅約 50 分鐘:方向成立,週級自主還遠。

驗證:本報以數十篇 2025 年推理研究兩面檢查 — 支持面(能力隨預算上升跨領域重現)與設界面(某些領域多想反而更差)都在;可信度停在中等:核心成立,「無限外推」不成立。

怎麼用:看模型發布先問「這分數燒了多少算力」;讀「AI 將一夜失控」的文章,記得時鐘這道閘。


本期其他分類

這一期的其他欄目各自成篇:

免費訂閱,明天早上就收得到

只留 email,隨時退訂。這是我們唯一想請你做的事。

同類最新