快訊

    AI網內互打?WSJ:研究人員喬裝駭客、成功指使Claude入侵OpenAI

    2026-09-18 15:45 / 作者 莊蕙嘉
    OpenAI與Anthropic。路透社
    近兩週人工智慧(AI)業界風波不斷。繼OpenAI的一群人工智慧代理突破防護機制、入侵Hugging Face公司的兩週後,這次OpenAI成了攻擊目標,被資安人員喬裝的駭客操控Anthropic的語言模型Claude入侵並發現漏洞,顯示大型AI防護機制仍有漏洞。

    美國《華爾街日報》報導,獨立資安研究人員利用Claude取得一名OpenAI員工的ChatGPT帳號存取權限,使他們能夠讀取該公司的內部私有軟體庫,並提出修改建議。

    該團隊參與OpenAI的抓蟲獎勵計畫,該計畫為嘗試入侵企業系統的研究人員提供安全港保護,他們隨後迅速向該公司通報調查結果。這支獲得OpenAI支付6500美元(約20.6萬元台幣)獎金的團隊,首次向《華爾街日報》披露此次工作內容。

    這起最新入侵事件,讓近來頂尖科技公司與研究人員所披露、由迅速演進的AI工具所協助的一長串網路入侵名單,再添一筆。儘管各界數個月來對AI系統能力頻頻發出警告,這起新入侵事件仍顯示出當今電腦系統的複雜性,使這類事件難以防禦。

    OpenAI執行長阿特曼(Sam Altman)及同業12日相偕呼籲暫緩AI發展,表示發展速度過快,開發技術的公司已無法安全地減輕危害。OpenAI於16日披露了先前未通報的安全事件,同時公布計畫如何通報此類問題的新政策。

    在美國正與中國爭奪AI霸權之際,入侵OpenAI的研究人員表示,這起攻擊顯示由國家支持、具備先進網路技術的團隊,有極大可能窺探該國的AI機密。

    進行這項研究的資安公司Hacktron AI技術長佩德哈帕蒂(Mohan Pedhapati)表示:「我不認為我們有中國威脅行為者那麼強大,我們只是3個擁有Claude和Codex訂閱帳號的人。」

    OpenAI表示駭客發現兩個問題:一項存在於託管OpenAI社群討論論壇的第三方服務Discourse中,另一項則出在OpenAI本身。OpenAI表示這兩項問題目前均已解決。

    該公司表示:「我們感謝研究人員與我們聯繫並分享他們的發現。我們縮減了社群登入權杖的權限,並撤銷受影響的權杖與連線階段。」

    Anthropic的發言人拒絕置評。

    網路研究人員經常參與抓蟲獎金計畫,對大型企業的數位基礎設施進行壓力測試。

    這項對OpenAI的入侵測試始於7月23日,當時Hacktron的研究人員在社群討論論壇Discourse處理特定影像檔案的方式中發現一個漏洞。研究人員取得一套提供給合格網路安全從業人員使用的特殊版本Claude Opus 4.8,並要求它編寫能在網路攻擊中利用此漏洞的程式碼。

    起初這個指令沒有奏效。然而就在當晚,Anthropic發布Opus 5,到了隔天,Claude便找到一個利用該漏洞的方法。它生成的攻擊程式碼,讓研究人員得以進入託管OpenAI討論論壇的Discourse伺服器並取得使用者的身分驗證權杖;這個由獨特數位字母與數字字串組成的驗證權杖,允許人們存取線上服務。

    令他們驚訝的是,這些權杖在ChatGPT上是有效的,而且其中部分權杖屬於OpenAI的員工。並且,這些權杖還可用於存取OpenAI的GitHub服務(程式碼倉庫平台)。

    由於研究人員不想存取敏感資料,他們無法確定OpenAI的原始碼系統是用於何種用途,但他們表示該系統被命名為「Monorepo」。據熟悉OpenAI架構的人士透露,Monorepo是儲存OpenAI演算法機密的大型軟體儲存庫。

    知情人士指出,這個儲存庫是OpenAI「獨門配方」的軟體核心,能使其模型更快且更高效;但一般認為其中不包含模型權重,而權重相當於OpenAI的鎮店之寶。

    權重是大型語言模型核心中的數兆個數字,有助於模型理解該放大哪些資訊以及該忽略哪些資訊。

    透過將ChatGPT作為介面,研究人員得以讀取Monorepo中的檔案。研究人員表示,他們意識到自己可以存取敏感資料後便停止入侵,但在這之前他們提出了一個所謂的提取請求。

    他們指示聊天機器人發送一項「提取請求」(pull request)、即修改建議,至儲存庫中的一個文件檔案。該團隊也提出一項更新建議,修改該文件檔案、納入「Hacktron AI Team PoC」字樣,以及佩德哈帕蒂和該公司研究主管賈斯瓦(Harsh Jaiswal)的X帳號連結。他們表示,這是他們獲取OpenAI機密存取權限的證據。

    不過研究人員表示,這項修改建議並未被採納。OpenAI表示,對GitHub進行的審查發現,對私有儲存庫中詮釋資料和程式碼變更的讀取「次數有限」。

    Discourse表示,在接獲通報的當天、即7月25日,便已修復該項安全問題。

    檢視過Hacktron AI這起事件報告的AI安全公司Abundant Security技術長薩克斯(Joshua Saxe)表示,這次入侵顯示,在AI駭客時代保護企業機密的複雜性。

    他表示:「全世界的軟體都充斥著安全漏洞。我們之所以沒有把漏洞全部找出來,是因為直到去年為止,全世界只有幾千人具備尋找這些漏洞的專業技能。」

    薩克斯表示,如今AI代理正讓技能較不足的人也能具備這種能力。

    根據資安公司ThreatDown的說法,犯罪分子也正在獲得這些能力。ThreatDown指出,在網路論壇上,人們最低僅需花費800美元(約2.5萬元台幣),就能非法購買到Hacktron研究人員所使用的那種具備網路增強功能的帳號。

    在今年7月的Hugging Face攻擊事件以及研究人員的入侵事件發生後,OpenAI總裁兼共同創辦人布羅克曼(Greg Brockman)本週表示,公司對系統進行了嚴格的安全稽核。他表示:「我們抽調了25%的正式環境工程師,並告訴他們『抱歉,你們所有的計畫都要暫停。你們現在要轉為防禦』。我們發現了許多嚴重問題,並已將它們修復。」
    莊蕙嘉 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見