大神觀點 · 本週 (發表日 07-25)
Nathan Lambert 對 Opus 5 追平旗艦給出機制解釋:他認為關鍵是「更快的迭代速度+規模化強化學習(RL)」,而旗艦模型「反而還太大、還沒法同樣做 RL」。若這個解釋成立,前沿進步的槓桿正從「把模型做更大」移向「在中型模型上快速迭代 RL」(原推文,07-25)。驗證: 單一觀點、且與官方發布同溯 Anthropic 一份公告,本報暫記待獨立第二源。
只留 email,隨時退訂。這是我們唯一想請你做的事。
Sebastian Raschka 是長期寫深度學習架構解說的技術作者,經營電子報《Ahead of AI》,與模型廠商沒有利害關係(Ahead of AI,2026-09-09)…
Evan Hubinger 是 Anthropic 對齊科學團隊的負責人;對齊是一個研究領域,目標是讓 AI 系統的行為符合人類意圖與價值。9 月 8 日他回應一名剛離職同事的長文…
對企業採購方來說,它影響的是「供應商對自己產品風險的內部評估」這一欄,而那一欄平常只能靠猜測。本報收的是「Hubinger 這樣說」,不是那個機率數字本身。 ⚠️ 那是他個人的主觀…
Zvi 9 月 7 日逐字寫:「Jakub Pachocki flat out says that no one is at a place where it would be r…