チップと半導体 · 今日 (公開は 9 月 10 日)
この記事の出典 2026年9月11日 夕刊
d-Matrix は AI の推論に絞ったチップの事業者になる。推論とは、モデルの訓練が終わったあと、実際に質問へ答えさせる側の計算を指す。同社は、次の世代の Raptor というカスタムの加速器に NVIDIA の NVLink Fusion を採り、自社のチップを NVIDIA のラックとネットワークの構成へ直につなぐと発表した(NVIDIA ブログ、2026-09-10)。NVLink Fusion は NVIDIA が他社のチップへ開いている広帯域の接続インターフェースで、NVIDIA 製ではない処理装置でも、すでに大量に配備され、供給網と液冷の付属品が揃った、あの標準のラックへ挿せるようにするものだ。共同創業者で最高経営責任者の Sid Sheth が挙げた理由は逐語で "Demand for inference is soaring, but capital, time and energy remain finite"、推論の需要は急に膨らんでいるが、資本も時間も電力も限りがある、になる。なぜこの一件を見ておくのか。 自社で設計するカスタムの加速器は、ずっと「NVIDIA への依存から抜け出す道」として語られてきた。ところがこの一件が示すのは、その道の最後の一マイルが、NVIDIA のラックとネットワークの標準へ戻りつつあることだ。省けるのは設計で、省けないのは配備になる。⚠️ これは NVIDIA 自身のブログの告知で、第三者による数値がなく、出荷の日程も価格もなく、すでに採った客の名前も挙がっていない。本紙は向きだけを使い、規模についての推論はいっさいしない。
harness とは、モデルの外側にある作業環境を指す。文脈を管理し、道具を呼び、下位の仕事を段取りし、途中の結果を残す、あの一式だ。これまではどの会社も自前で書いていた糊にあたる…
電子設計自動化と AI のチップ設計の道具を売る五社の製品責任者が、非公開の円卓でこう語った。この一年で、顧客の AI エージェントについての話は、上限のない予算から、技術者ひとり…
9 月 9 日、OpenAI が企業版の発表文を出し、このモデルの立ち位置を「いちばん賢いモデル」から「一ドルあたりいちばん多く役に立つ仕事をする」に書き換えた。あわせて API …
最高財務責任者 Sarah Friar の署名がある OpenAI の文書が、自社開発の推論チップ Jalapeño の数値をはじめて出した。三つの公開モデルで測ったところ、1 ワ…