モデルの読み · 今週 (論文の公開 2026 年 8 月)
この記事の出典 2026年8月29日 夕刊
米国のノースイースタン大学(Northeastern University、ボストンにある研究型の大学)の研究者 4 人が 8 月、ROBBIN という名前の論文をプレプリントのサーバー arXiv に置いた(原文、2026 年 8 月;本紙が読んだのは、半導体の業界媒体 Semiconductor Engineering が 8 月 29 日に出した要約になる、原文、08-29)。
先に Rowhammer が何かを書く。十数年前から知られているメモリへの攻撃の手口だ。メモリのある行を高速で繰り返し読み書きすると、物理的に隣り合う行でビットが反転する。権限のないところで他人のデータを書き換えられることになる。そして新しいのは、この論文の順番になる。 これまでのやり方は、まずハードウェアに依らない裏口を設計し、それをビットの反転でどう実現するかを後から考えるもので、うまく反転しなかった部分は副作用として扱われた。この論文は逆をやる。まず対象のメモリがどの位置で反転するかを測り、その地図のとおりに、モデルの重みをどのページへ置くかを決める。要約の原文は反転の一つひとつを「an integral part of the attack design」(攻撃の設計に欠かせない一部)と呼んでおり、こうして作った裏口は機器をまたいでも保つと著者は主張する。
⚠️ 正直な境界を書き切る。これはプレプリントで、査読を通っていない。本紙が読んだのは要約だけで全文は読んでおらず、独立した再現も見ていない。要約にある二つの略語(ASR と TA、この種の研究では通常、攻撃成功率と、通常の作業の正確さを指す)は数字が一つも出ていない。だから「この手口が実際どれだけ効くのか」は今日答えられない。
これはあなたにとって: 推論の容量を買うときに、質問を一つ足すことになる。借りたその GPU は、メモリを誰と共有しているのか。自分で見張れる拠り所: 別のチームが別のハードウェアでこの結果を再現するかどうか。再現が出るまで、これは可能性の実演であって、外で実際に起きていると分かっている危険ではない。
2025 年 12 月 20 日、OpenAI は〈Monitoring Monitorability〉を発表し、「思考の連鎖はどれだけ監視しやすいか」を測れる指標にした。最も重要…
CyberGym はバークレーのチームが作った公開試験で、実在の脆弱性 1,507 件を収め、188 のオープンソース事業をカバーする。データは Google が運営するオープンソ…
先に説明しておく。いまの大きなモデルの多くは専門家混合(MoE)という構えを取る。すべての語でモデル全体を走らせるのではなく、語ごとに少数の専門の子モデルへ振り分ける。だからモデル…
米国のアレン人工知能研究所が 9 月 1 日、BenchMIRT を発表した。項目反応理論の多次元版を使い、ある評価指標が結局のところ何を量っているのかを一問ずつ分解する。もともと…