大神觀點
本篇出自 2026年7月19日 晨報
他逐份比對六家開放權重模型的技術報告,發現「可調推理力度」(讓使用者決定模型答題前想多久、想多深)的訓練配方已趨於同一套三段框架,正式從研究特性變成出廠標準(原文)。一個具體數字:Kimi 的做法在自家模型上減少約 25-30% 的生成用量,而在 Kimi 自報、未具名的內部評測上跑分幾乎不掉(經 Raschka 轉述)。這支持本報 2026/7/16 期「OpenAI 讓新一代模型漲價 2 倍」那期背後的判斷線:模型能力與成本,越來越取決於推理當下投入多少算力;現在「模型多大」與「想多久」是兩個獨立的採購旋鈕,小模型調高力度有時能追平大模型。註記:他的綜述橫跨六份一手報告,但對本報而言仍是單一來源,具體數字待回各家原始報告。
只留 email,隨時退訂。這是我們唯一想請你做的事。
Nathan Lambert 對 Opus 5 追平旗艦給出機制解釋:他認為關鍵是「更快的迭代速度+規模化強化學習(RL)」,而旗艦模型「反而還太大、還沒法同樣做 RL」。若這個解…
Dwarkesh Patel 是獨立科技訪談者與作者,其 AI 產業深度論述常被業界轉引。他 6 月的文章主張:每個要教給模型的技能,背後對應至少數百位人類專家寫示範與評分標準;專…
Thompson 是科技戰略電子報 Stratechery 的作者、產業判讀最受引用的分析者之一。在華府與華爾街同聲恐慌的一週,他的判斷反著走:中國開源模型的威脅並不新;前沿實驗室…
Mollick 是賓州大學 Wharton 商學院教授,企業界讀者最多的 AI 實用主義評論者。他以第一手實測給出 2026 下半年的判讀:要拿 AI 做真工作,實務選項只有 Ch…