SecondSource一次情報から判断を組み立てる
モデルの読み · 2026年9月8日

2.6B パラメータのオープンソースのモデルが、9B に並んだ。

モデルの読み · 今日 (公開日は 9 月 7 日)

この記事の出典 2026年9月8日 夕刊

独立の評価機関 Artificial Analysis が 9 月 7 日に公表した。OpenBMB の MiniCPM5-2B(稠密パラメータ 2.6B、Apache 2.0 ライセンス)は、同社の Intelligence Index v4.2 で 15 点を取った。4B 以下のオープンソースのモデルでは最高で、Qwen3.5 9B と並ぶ。銀行の顧客対応のエージェントを測る τ³-Banking では 21% を取り、次点は 8% しかない。ただし知識のテスト AA-Omniscience では −12 になる。これは 29% の問題にしか答えず残りを棄権し、しかも 1 問あたり平均 19,000 トークンを出力してのことだ(@ArtificialAnlys、2026-09-07)。(正直に断っておく。このテストには負の点数が出る。誤答に減点があるという意味になるが、正確な採点規則を本紙は取得していない。)⚠️ 第三者による評価であり、確かめられる。記す値打ちがあるのは点数ではなく、「小さなモデルが、よく考えてあまり答えないこと」で取った点数だという点になる。これを遅延と費用へ換算するには、別に測る必要がある。

note で無料購読——今日の夕方から届きます

note のフォローだけ。いつでも解除できます。お願いするのはこれだけです。

note をフォローする(無料)

同じ分類の最新