チップと半導体 · 今週 (公開日 8 月 30 日)
この記事の出典 2026年8月31日 夕刊
オックスフォード大学の研究チームが論文を発表した。高帯域フラッシュメモリは一段あたりの容量が現行の高帯域メモリの 16 倍で、帯域は同等になる。推論で大きなモデルが収まらないという問題の答えに見える。ところが、そのまま置き換えると性能はひどく落ちる。フラッシュメモリのロングテールの遅延が、GPU の実行順を決める仕組みを空待ちさせるからだ。彼らのやり方は、二種類のメモリを混ぜて使い、予測によって遅いほうを重要な経路から外すことにある(Semiconductor Engineering、08-30;論文の原文、IEEE Computer Architecture Letters、2026 年 8 月)。記憶しておく理由: 今日の中核 1 点目と 2 点目はどちらも推論にかかる金の話で、その推論コストの物理の底は「モデルがメモリに収まるかどうか」で詰まっている。容量が 16 倍安くなるのは大きな数字だが、引き換えに出てくるのが遅延だ。この帳尻は、まだ誰も計算し終えていない。終わるまでは、「メモリが安くなる」という筋の推論はどれも半分欠けている。計算が終わった合図は、混ぜた設計が実際の推論負荷でどれだけの遅延になるかの実測が公開されることであって、もう一つの容量の倍数ではない。
9 月 3 日の Daybreak for Frontline Defenders の発表は、防御側がフロンティアのセキュリティ能力を使うための補助に十億米ドルを約束した。米国から…
Broadcom はカスタムの AI 加速器とネットワーク用チップを作る会社で、超大規模クラウド事業者が自前のチップを設計するときの主な相手になる。だからその売上は「大手が NVI…
エージェント型のコーディング道具が企業へ入るとき、最大の障壁はずっと「自社のソースコードと鍵がネットワークの外へ出るのか」だった。Cursor は 9 月 2 日、自前で立てる機械…
いまの価格は入力 100 万トークンあたり 0.75 ドル、出力が 3.75 ドルで、同じページには、これが優待の価格であること、2026 年 12 月 31 日に期限が切れること…