SecondSource從一手資料重建判斷
模型觀點 · 2026年9月8日

一個 2.6B 參數的開源模型,追平 9B。

模型觀點 · 今日 (發表日 9 月 7 日)

本篇出自 2026年9月8日 晨報

獨立評測機構 Artificial Analysis 9 月 7 日公布,OpenBMB 的 MiniCPM5-2B(2.6B 稠密參數、Apache 2.0 授權)在它的 Intelligence Index v4.2 得 15 分,是 4B 以下開源模型最高,與 Qwen3.5 9B 持平;在銀行客服代理人測試 τ³-Banking 拿 21%,次佳只有 8%;但在知識測驗 AA-Omniscience 得 −12,靠的是只回答 29% 的題目、其餘棄答,而且每題平均輸出 19,000 個 token(@ArtificialAnlys,2026-09-07)。(誠實說明:這個測驗會出現負分,代表它會倒扣,但確切的計分規則本報未取得。)⚠️ 第三方評測,可核;值得記的不是分數,是「小模型靠多想、少答」換來的分數,換算成延遲與成本要另外量。

免費訂閱,明天早上就收得到

只留 email,隨時退訂。這是我們唯一想請你做的事。

同類最新