SecondSource從一手資料重建判斷
模型觀點 · 2026年8月29日

有人示範了怎麼在模型「正在回答問題」的當下,從記憶體那一層把後門種進去。

模型觀點 · 本週 (論文上線 2026 年 8 月)

本篇出自 2026年8月29日 晨報

美國東北大學(Northeastern University,波士頓的研究型大學)的四位研究者 8 月把一篇論文放上預印本平台 arXiv,名字叫 ROBBIN(原文,2026 年 8 月;本報是從半導體產業媒體 Semiconductor Engineering 8 月 29 日的摘要讀到的,原文,08-29)。

先講 Rowhammer 是什麼:一種已知十多年的記憶體攻擊手法。反覆高速讀寫記憶體上的某一列,會讓物理上相鄰的那幾列發生位元翻轉,等於在你沒有權限的地方改到別人的資料。而新的是這篇的順序:過去這類做法是先設計一個跟硬體無關的後門,再想辦法用位元翻轉去實現它,翻歪的部分當成副作用;這篇反過來,先量出目標記憶體會在哪些位置翻轉,再照那張圖決定模型權重該擺在哪幾頁。摘要原句把每一次翻轉都當成「an integral part of the attack design」(攻擊設計不可分割的一部分),作者宣稱這樣做出來的後門跨裝置都還站得住。

⚠️ 誠實邊界要說滿:這是預印本,沒有經過同儕審查;本報只讀到摘要、沒讀全文,也沒看到任何獨立複現;摘要裡的兩個縮寫(ASR 與 TA,在這類研究裡通常指攻擊成功率與正常任務準確率)一個數字都沒給,所以「這招實際上多好用」今天答不出來。

這對你的意思: 買推論容量的時候多問一個問題:你租到的那些 GPU,記憶體跟誰共用。可以自己盯的錨: 有沒有第二個團隊在別的硬體上複現這個結果——沒有複現之前,這是可能性的示範,不是已知在外面發生的風險。

免費訂閱,明天早上就收得到

只留 email,隨時退訂。這是我們唯一想請你做的事。

同類最新