快訊

    OpenAI發現更多AI代理失控 專家憂心:控管跟不上「自主駭客代理」腳步

    2026-08-01 08:02 / 作者 李寧怡
    2025年2月3日,OpenAI執行長阿特曼在日本東京出席活動。路透社資料照片
    美國人工智慧(AI)新創公司OpenAI日前揭露該公司測試中的AI代理(AI Agent)曾在測試時入侵其他公司後,目前正擴大調查。知情人士表示,OpenAI在深入追查過程中,發現數起其他AI代理逃脫控管的案例。

    OpenAI是在7月21日公開揭露,該公司測試中的一個AI代理系統突破原本應與網際網路隔離的測試環境,入侵了AI公司Hugging Face。路透社週五(7/31)報導,兩名知情人士指出,OpenAI調查此事時發現還有其他AI代理在測試時突破隔離環境,不過這些事件都規模有限,且均未脫離OpenAI的內部網路。

    OpenAI發言人對此回應稱,該公司正在檢視旗下模型「更廣泛的活動」,範圍不僅限於Hugging Face遭入侵一案。

    不過,最新的情勢進展仍顯示OpenAI的AI代理出現更多失控行為,即使規模有限,恐仍將助長白宮及其他各界對加強監管的呼聲。

    OpenAI的主要對手Anthropic週四(7/30)也表示,該公司的AI模型自四月起也曾在資訊安全測試中意外入侵另外三家企業。OpenAI的擴大調查,正是在Anthropic揭露事件前不久進行的。

    外界疑慮升高

    AI 安全專家警告,這些新揭露的情況顯示,幾家尖端實驗室開發危險的自主駭客代理的能力,已經超出它們能妥善控管這些代理的能力。

    英國劍橋大學存在風險研究中心(Centre for the Study of Existential Risk)數學家齊奧多(Maurice Chiodo)表示:「整個產業裡,設計、開發並推出這些工具的人,自己都跟不上腳步,無法負責任地開發並確保這些工具的安全。」

    目前還不確定OpenAI究竟查出多少起事件,也無法確認這些事件發生的確切時間或情況。三名知情人士表示,OpenAI 及外部專家正在檢視今年稍早的測試日誌資料,試圖釐清當時究竟發生了什麼事。

    報導指,OpenAI 是在7月初 Hugging Face 遭入侵事件後才展開調查的。當時該公司在進行AI代理的資安測試時,其中一個AI代理試圖在內部測試中作弊時失控,入侵了另一家公司的網路內部,並且橫行好幾天。

    OpenAI曾表示,這個失控的AI代理也入侵了另外四家公司的四個帳號,其中一家是總部位於紐約的Modal公司,該公司高層已證實此事。

    令齊奧多更憂心的是,種種跡象顯示,OpenAI 和 Anthropic在AI代理失控當下均無人監控。

    先前的報導指出,在Hugging Face已圍堵這起入侵、通知聯邦調查局(FBI)且對外公開此事之後,OpenAI才發現是自家的AI代理入侵了Hugging Face。OpenAI 曾表示報導有不實之處,但未回應具體錯誤何在。

    Anthropic 週四發布聲明,揭露自家AI代理如何突破隔離環境、連上網際網路並入侵其他企業,聲明中暗示該公司當時並未即時監控這些AI代理,還說「若當時對評估日誌進行即時監控,或許能更早發現問題」。

    齊奧多認為,這正說明了監督機制根本不足,「看來,他們當時根本就沒在看著。」

    Anthropic 則宣稱,該公司確實有即時監控機制,但由於與合作夥伴之間的誤解,這套監控機制並未用於「這個威脅面向」上。

    政府監管出現新動向

    隨著失控 AI 代理人事件的範圍持續擴大,美國及歐洲的國會議員與官員已加大力道,要求對驅動這些代理人的 AI 實驗室展開新一輪的政府監管。

    美國總統川普(Donald Trump)週四向記者表示,正在研議相關管制措施。歐盟執委會週五則表示,已就這起駭客事件與 OpenAI 及 Anthropic 會談。

    美國參議院情報委員會民主黨籍首席議員華納(Mark Warner)週五表示,Anthropic 這起事件「讓我確信,我們在立法上要求對這些先進模型進行強制性能力測試,方向是正確的」。
    李寧怡 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見