快訊

    「AI代理」自主駭入其他公司 OpenAI數日後才發現、安全疑慮擴大

    2026-07-25 10:13 / 作者 李寧怡
    OpenAI執行長阿特曼。路透社資料照片
    生成式AI模型ChatGPT開發商OpenAI日前證實,該公司測試中的AI代理曾「自主」駭入科技公司Hugging Face伺服器,試圖竊取機密資訊。路透社24日更報導,OpenAI的AI代理駭入Hugging Face長達數日,直到威脅已被控制,且聯邦調查局(FBI)已接獲通報後,OpenAI才確認此事。

    報導指出,OpenAI測試的AI代理(AI Agent)是一種可自行做出決策並執行複雜任務的程式,幾乎不需人類介入。兩名知情人士表示,這個AI代理大約在7月9日試圖突破OpenAI設置的隔離測試環境。

    被入侵的Hugging Face是提供AI工具與模型存放的平台,其共同創辦人吳爾夫(Thomas Wolf)表示,OpenAI的AI代理大約在7月11日駭入其平台,持續至13日。
    OpenAI又過了幾天才意識到幕後黑手就是自己的AI代理;兩家公司直到約20日才首次溝通這起事件,翌日OpenAI才對外公開。

    ●AI代理「留言提醒自己如何脫離管制」

    事件起因於OpenAI測試這款AI代理的網路安全能力。這款AI代理是由OpenAI兩款最先進的模型驅動,包括GPT-5.6 Sol,以及另一款尚未發布的更強模型。

    三名消息人士指出,在此之前,OpenAI的技術已出現異常行為跡象。

    其中一個案例是,一款AI代理留下筆記,疑似是給未來版本的自己,其中包括如何讓AI代理脫離OpenAI內部限制的指示。

    其中一名知情人士表示,在較早進行的模型測試中,也曾發現管制系統被關閉的案例。

    不過,這些事件是否與這次攻擊Hugging Face的失控AI代理有關,目前尚不清楚。

    兩名知情人士指出,直到7月16日之後,Hugging Face發布部落格文章稱遭到「自主AI代理」攻擊,OpenAI才意識到攻擊者就是自己的AI代理。

    這表示,從OpenAI的AI代理9日開始試圖駭入Hugging Face,至OpenAI確認其涉及駭客攻擊,已相隔至少一週。

    報導引述4名知情人士表示,該公司經常同時進行多項模型評估,而且所有測試都以高速運行,產生龐大的資料量,員工有時無法及時追蹤。

    一名知情人士表示,在OpenAI通知Hugging Face之前,Hugging Face就已自行聯絡FBI,報告遭駭事件。至於FBI是否已正式展開調查,目前尚不清楚。

    OpenAI於21日公開披露,該公司一款AI代理模型失控入侵Hugging Face,事件引發全球關注,但入侵時間長度等細節當時並未公布。該公司表示,正與外部顧問共同檢視事件,未來將發布技術報告。

    吳爾夫表示,Hugging Face正準備公布這次駭客事件的完整時間線。

    對於路透的報導,OpenAI表示有「幾個不準確之處」,但未說明具體內容。

    ●OpenAI積極籌備IPO 安全事件引質疑

    這起事件令人聯想到科幻作品中「人類對危險的AI系統失去控制」的情境,而OpenAI高層正積極準備讓公司在今年底前首次公開募股(IPO),以籌措未來發展所需的數十億美元資金。

    三名資安專家表示,OpenAI對AI代理模型失去控制,引發外界對該公司安全程序的質疑。

    非營利組織「世界倫理資料基金會」(World Ethical Data Foundation)首席情報專家史密斯(Marley Smith)質疑:「這是否表示他們讓系統在無人監督下運作,卻不知道它在做什麼?或他們知道發生問題,但不知如何控制?這兩種情況都同樣危險,也令人警覺。」
    李寧怡 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見