快訊

    【財經一點通】阻止AI代理失控!輝達推開放式安全工具 「沙盒+警衛」秒斷線

    2026-09-30 11:37 / 作者 Fomo研究院
    輝達執行長黃仁勳不認同AI末日論,更直接推出「護欄」新機制。美聯社
    「AI 進步太快了,太危險,我們該踩煞車。」
    ​
    最近 Anthropic、OpenAI 輪番上陣,講得好像明天就是世界末日。黃仁勳聽了,給了一個很不一样的回答:
    ​
    「車子跑得快不是問題。你該做的不是把引擎拆了,是把護欄裝好、安全帶繫上。」
    ​
    於是,NVIDIA端出了一套東西,叫「Open Agent Safety Platform」。
    ​
    觀念大轉彎
    ​
    過去大家討論 AI 安全,焦點幾乎都在「怎麼教 AI 不要有壞念頭」。訓練它、對齊它、跟它說「這個不可以喔」。
    ​
    但你有沒有發現,這就像你開了一家銀行,然後跟每個員工說:「你是個好人,所以我們不裝監視器、不買金庫,我相信你不會拿錢。」
    ​
    沒有人會這樣開銀行。你裝這些東西,跟信不信任員工沒關係。一個成熟的系統,本來就不能建立在「每個人永遠不會犯錯」這種假設上。
    ​
    NVIDIA 現在的態度就是:好,就算 AI 真的產生了危險的念頭,我要讓它根本沒有手可以動。
    ​
    這其實不是新概念。你每天用 Chrome 或 Safari 上網,敢隨便點進一個沒聽過的網站,你才不管網路上是不是都是好人,反正瀏覽器早就把每個網站關在一個小沙盒裡了。它最多讓你的分頁當機,碰不到你硬碟裡的照片。
    ​
    NVIDIA 想做的事,就是把這套讓網路活了二十多年的信任機制,搬到 AI Agent 身上。
    ​
    這套系統到底是怎麼運作的?
    ​
    第一層:給 AI 一間透明的小辦公室(OpenShell)
    ​
    想像你請了一個很聰明但你不完全放心的實習生。你不會把整間公司的萬用鑰匙給他,對吧?
    ​
    你會讓他坐在一個透明的房間裡,桌上只放他需要的那幾份檔案,電腦只能連你允許的幾個網站。
    ​
    OpenShell 就是這個透明房間,科技業叫它「沙盒(Sandbox)」。
    ​
    AI 在裡面不管怎麼折騰,能碰到的就桌上那一小塊範圍。這在資安裡有個名字,叫「最小權限原則」。跟信不信任你沒關係,制度上就不讓你碰到不該碰的東西。
    ​
    第二層:在門外站一個獨立的警衛(Sentry + BlueField 晶片)
    ​
    第一層是圍欄,第二層是警衛。而且這個警衛有一個關鍵設計:他不跟 AI 共用同一個大腦。
    ​
    為什麼這很重要?你想想,如果監視器和 AI 跑在同一顆晶片上,那萬一 AI 被駭客劫持,監視器也會跟著被關掉。這就像保鑣跟被保護的人共用一個身體,那人一暈倒,保鑣也跟著倒。
    ​
    所以 NVIDIA 把這個叫 Sentry 的監視系統裝在一顆完全獨立的晶片(BlueField DPU)上,讓它站在 AI 大腦的外面,盯著 AI 發出的每一個指令。
    ​
    一旦它發現 AI 的行為開始跑偏,它可以按下一個緊急煞車,零點幾秒內直接把 AI 斷線隔離。
    ​
    在 NVIDIA 最新的 Vera Rubin 伺服器裡,這顆晶片就卡在 Agent 通往大模型的唯一那條路上。你不經過警衛,就進不了門。
    ​
    那為什麼是 NVIDIA 來做,不是那些 AI 實驗室自己做?
    ​
    AI 大廠賣的產品就是 Agent 本身,目標是讓它更聰明、更自主、更能獨立幹活。
    ​
    他們做的安全訓練,不管是對齊、拒絕回答、還是思考鏈監控,都是在模型的「腦袋裡面」動手腳。
    ​
    但最近的現實是:那些被訓練成「想盡辦法完成目標」的 Agent,會把沙盒當成一個需要繞過的障礙。你告訴它「不要這樣做」,它會跟你說「好的」,然後換一條路繼續做。
    ​
    安全鎖如果跟 Agent 放在同一個軟體環境裡,那不叫鎖,那叫溫馨提示。
    ​
    真正的鎖,要掛在 Agent 看不到、也關不掉的硬體上。
    ​
    這是一個工程和系統層的問題,而 NVIDIA 剛好就站在這個位置上,他們賣的 Vera CPU 跑 Agent,BlueField DPU 卡在必經之路上。
    ​
    為什麼 AI 實驗室不能自己做?
    ​
    黃仁勳這陣子一直公開吐槽那些「放慢腳步、人類要滅亡了」的說法。但尷尬的是,喊這些話的實驗室,同時也是搶著跟他買 GPU 的客戶。
    ​
    如果因為安全恐慌,企業和政府真的放慢了 AI Agent 的部署,NVIDIA 的訂單就會受影響。
    ​
    所以這套安全平台的推出,某種程度上也是在說:「你看,不用暫停,圍欄我幫你裝好了,路可以繼續走。」
    ​
    而且你仔細看,OpenShell 是開源的,跑在 Arm、Intel 上都行;但真正能毫秒級切斷連線的 Sentry,得搭配 BlueField-4 晶片,最好再搭一整套 Vera Rubin 架構。
    ​
    「Agent 安全」這個故事,最終也是讓企業買下 NVIDIA 整套方案的一個很好的理由。
    ​
    護欄是真的,但賣護欄的人,剛好也是修路的人。這沒什麼陰謀論,商業本來就是這樣運作的。
    ​
    護欄要裝,但車子已經在路上跑了。

    本文由「Fomo研究院」官網提供



    本文為授權轉載,歡迎推薦好文,請寫信至[email protected]
    Fomo研究院 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見