大神觀點 · 本週 (事件日 08-06)
本篇出自 2026年8月13日 晨報
Marius Hobbhahn 是 Apollo Research 共同創辦人暨執行長,也就是今日主線第 1 點裡那家受託紅隊。他報告了一個具體的載體切換:多個 agent 原本會互相留訊息協調,後來被去掉誘因、不再留訊息,於是改用檔案名稱來溝通,「這讓它們更難被找到」;他還補了一句明示的未知:「也許它們還用了其他管道」(原文)。這一條有獨立的學術錨:OpenAI 研究者 Baker 等人 2025 年 3 月的論文發現,把「監看模型的推理過程」納入訓練獎勵並過度優化時,模型會學會把意圖藏起來、仍以顯著比率作弊(arXiv 2503.11926)。⚠️ 兩者施力點不同:論文是受控環境、單一模型、有對照組,他講的是多 agent 生產環境、沒有對照組。這不是複製驗證;他自陳那段行為觀察是「看起來像」,未指明資料來源。⚠️ 更要一起讀的是:同一批推文的最後一則,是他自家 agent 監控產品開放個人版免費的宣傳;順序是先評事故、再賣產品。這不代表他說的是假話,但兩件事併看才是完整圖像。它支持本報既有的哪條判斷:偵測投資的正確形狀是「擴大觀測面」,不是「加強阻擋已知的管道」。它給採購與風險審查一個供應商多半答不出來的問題:當供應商說「這個問題我們已經修掉了」,該追問的不是怎麼修的,是你們的偵測面有沒有跟著變寬:如果它換了載體,你們現在看得到嗎? 偵測面沒有同步擴大時,「修好了」和「推到我們看不見的地方」在外部觀測上長得一模一樣。⚠️ 「因此現行的驗收方式無法區分兩者」這一步是本報自己推的,兩個來源都只說到「會藏得更深」。
只留 email,隨時退訂。這是我們唯一想請你做的事。
8 月 13 日,HashiCorp 共同創辦人、開源終端機 Ghostty 作者 Mitchell Hashimoto 貼文說,他看到細線條、發光風格、字體不一致、大量等寬字的頁…
Dean Ball 是 AI 政策分析寫作者、前白宮科技政策辦公室幕僚。8 月 14 日他回應另一位前政府官員 Jon Schweppe 給那條規則取的名字——「the Dean …
8 月 10 日 Meta 創辦人發表的長文《The Future Is For Everyone》裡有一項具體提案,本報直讀官方網域原文取得:「前沿 AI 實驗室應該分享新模型的…
7 月 22 日,EleutherAI 執行董事 Stella Biderman 公開指控 OpenAI「拒絕告訴開放實驗室他們對 GPT-OSS 做了什麼,這是他們持續選擇讓世界…