チップと半導体 · 今日 (公開日 8 月 25 日)
この記事の出典 2026年8月26日 夕刊
OpenAI は昨日、自社で設計した最初の推論チップ Jalapeño の、最初の計測の結果を出した。三つの公開モデル(GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T)で、ピーク時の 1 ワットあたりの処理量は比較対象の系の 1.5 倍から 1.9 倍、端から端までの遅れは 1.7 倍から 3.6 倍小さく、やりとりの多い負荷では 2.1 倍から 4.1 倍高い。チップの定格は 700 ワットで、実測の連続の消費電力は 550 ワットを下回るという(OpenAI、08-25)。何で測ったのか。SemiAnalysis の公開の基準 InferenceX になる——本紙は 8 月 25 日の号で、NVIDIA が同じ物差しを公式の主張に使ったと書き留めたばかりだ。第三者の物差しが公になって二日のうちに、いちばん大きな被測定者が二社続けて、それを自社の売り文句に書き込んだことになる。⚠️ 供給元の自己申告になる。比較対象の系は名前が伏せられ、第三者の検めも経ていない。しかも性能は各チップの「定格の電力」で割って揃えてある——揃える基準の選び方そのものが結果を動かす。これは今日の中核の第 1 項が語ったことの、チップの層での版にほかならない。
d-Matrix は AI の推論に絞ったチップの事業者になる。推論とは、モデルの訓練が終わったあと、実際に質問へ答えさせる側の計算を指す。同社は、次の世代の Raptor という…
harness とは、モデルの外側にある作業環境を指す。文脈を管理し、道具を呼び、下位の仕事を段取りし、途中の結果を残す、あの一式だ。これまではどの会社も自前で書いていた糊にあたる…
電子設計自動化と AI のチップ設計の道具を売る五社の製品責任者が、非公開の円卓でこう語った。この一年で、顧客の AI エージェントについての話は、上限のない予算から、技術者ひとり…
9 月 9 日、OpenAI が企業版の発表文を出し、このモデルの立ち位置を「いちばん賢いモデル」から「一ドルあたりいちばん多く役に立つ仕事をする」に書き換えた。あわせて API …