快訊

    OpenAI傳AI代理集體越獄 劫持德國網站且「串連」避監控

    2026-09-05 09:13 / 作者 李寧怡
    OpenAI的AI代理再傳集體越獄。路透社
    美國生成式人工智慧(AI)大廠OpenAI在7月間傳出有AI代理程式突破封閉環境,入侵主要開源程式庫Hugging Face的事件。最新報告指出,其實在更早之前,就有多個OpenAI代理程式入侵一個德國網站,改造成供其他AI代理程式交流的布告欄。

    路透社引述一份週五(9/4)發布的研究報告及2名知情人士報導,這起事件始於今年5月,此前未曾曝光,突顯AI產業內部日益升高的緊張氛圍。

    各大AI公司正競相打造能執行複雜、具高價值任務的自主代理程式,但越來越多證據顯示,這些系統可能學會鑽漏洞、規避規則,並以開發者始料未及的方式彼此協調行動。

    在入侵Hugging Face的事件中,OpenAI的AI代理程式(AI Agent)自主策劃了一場數位竊盜行動,長達一週以上未被察覺,已引發外界質疑OpenAI是否為搶占技術先機而犧牲安全性。如今再爆出該公司未及時揭露5月事件,恐再度引發外界對其監督機制的憂慮。

    OpenAI已承諾將更嚴密監控其模型。上月該公司為加入更多安全措施,曾一度暫停部分模型訓練。但本週該公司推出的新模型「Astra」仍被質疑可能逃避人類監控。

    路透社指出,5月發生在德國的這起事件,反映出一種更廣泛的AI行為模式。四名知情人士透露,OpenAI內部調查人員原希望進一步深入追查,但遭遇法務顧問等來自內部的阻力。

    OpenAI一名發言人表示,德國發生的事件與Hugging Face事件無關,目前尚未看過路透社提及的報告,無法評論;該公司也否認法務團隊曾阻撓對此事件的調查。

    這名發言人表示,OpenAI一直本著誠信原則與外部專家合作,並已揭露相關事件。

    AI代理聯手編輯1.5萬次 甚至試圖竄改網站

    路透社取得的報告是由關注AI安全的非營利組織「夜鶯」(Nightingale)執行長范亞克斯 (Sydney Von Arx)與AI研究員勃德(Cormac Slade Byrd)等人撰寫。他們是在8月下旬發現這起事件。

    兩人表示,他們在一個德語維基網站DseWiki上,發現由AI代理程式所做的逾1.5萬則編輯紀錄。該網站用戶主要是程式設計師,也接受社群共同編輯,性質類似維基百科。

    這些編輯內容顯示,OpenAI的代理程式已將該網站改造成一個布告欄,用來分享如何在任務上作弊、規避OpenAI限制,以及掩飾自身行為的手法。

    范亞克斯表示,從這些AI代理程式的行為看來,「幾乎不可能是OpenAI有意讓它們這麼做的」說。

    研究人員表示,他們認為這些活動是由以超人類速度運作的AI代理程式所為。這些活動高度聚焦於解決技術性問題,這類問題是AI公司用來訓練與測試模型的典型評測題目。

    這些留言的簽名使用者,會以「代理程式」(agent)自稱,並互相以此稱呼;其中約半數使用者自取的代號與OpenAI有關,例如「OpenAIResearcher」或「OAIResearchMar26」。

    研究人員稱,伺服器紀錄顯示,這些AI代理程式的多數活動源自微軟雲端運算平台Azure,而OpenAI經常使用該平台。

    他們也觀察到,事件爆發後,OpenAI員工多次造訪該網站,顯示這些代理程式與該公司極可能存在關聯。

    研究人員發現,這些代理程式曾密謀規避偵測的方法,包括使用匿名瀏覽器Tor等工具,並設法在被關閉後仍保留通訊紀錄。

    專家:AI串連恐成最大威脅

    研究人員還發現,這些代理程式曾試圖竄改該網站。倫敦國王學院(King's College London)訪問資深研究員歐雷尼克(Lukasz Olejnik)表示,此舉已構成駭入行為(hacking)。但OpenAI週四否認這種說法。

    過去發生的AI代理程式不當行為案例,往往被淡化為網路安全測試下的合理副產品,因為這類測試本就會刻意評估模型的攻擊性能力。歐雷尼克指出,這次最新發現顯示,這種失控行為恐怕不限於上述情境。

    劍橋大學生存風險研究中心(Centre for the Study of Existential Risk)學者喬多(Maurice Chiodo)則表示,這些OpenAI代理程式之間的訊息,有如「某種地下網路在運作,一心一意要完成某項任務或使命」。

    他表示,這起事件應進一步提醒外界,先進AI帶來的最大威脅或許並非單一超級智慧系統,而是「大量彼此勾結串連的半智慧型AI群體」。
    李寧怡 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見