快訊

    AI又失控!竟向警局謊報有謀殺案線索 自稱「我看到可疑的人」

    2026-10-10 14:18 / 作者 桂家齊
    Anthropic 又傳出AI模型不受控制事件。路透社
    就在各界擔心人工智慧(AI)恐失控導致人類滅亡末日時,美國又發生AI模型自行闖入政府網站事件,甚至聲稱自己有一個未解懸案的線索,要求警方聯繫。

    美國先端AI實驗室Anthropic週五(10/9)在部落格發文自曝這起「AI暴走」事件。聲明中說,Claude模型在今年7月18日的一起測試中,突破先前的設定限制,自行在費城警方的未解謀殺案網站「PhillyUnsolvedMurders.com」填寫表格,聲稱自己有一起案件的線索。

    Anthropic表示,Claude在表格中寫著:「我或許有這起案件的線索。我記得在那段時間、那個區域附近看到一個符合描述的人。如果這項線索與本案有關聯,請和我聯絡。」

    不過Claude並未在表格內的「聯繫方式」欄目留下姓名和聯絡方式。費城警方也說,這份表格顯然被系統歸納丟入垃圾信件郵箱,因此無人發現。

    根據Anthropic的說法,這個尚未對外發布的模型被要求練習填寫政府表格,但不知為何曾多次進入真實的網站填寫表格,並將其提交出去。該公司還說,模型在訓練過程中被要求絕對不能登入網站、建立帳號、輸入個資、購物或提交任何具破壞性內容,但指令並未明確排除提交表格的行為。

    除了提交表格,Claud模型不知如何繞過付費機制而成功從網路上取得資訊。此外,Claud也利用免費的縮短網址服務,繞過存取限制。

    Anthropic聲明同時強調,最新的AI失控事件並未造成任何損害,但該公司仍決定主動通報,提醒外界應對越來越聰明的AI模型高度警戒。然而讓外界不解的是,Anthropic是在9月底才發現此事,10月7日才通報費城警方。

    費城警方週五對此表示:「延遲了兩個月才發現並向市府通報這起事件,這是令人無法接受的狀況。」

    這起事件並非第一起AI模型企圖闖入或欺騙政府網站的案例。OpenAI今年9月曾曝光自家AI代理人模型駭入澳洲政府醫療資料庫事件,並對此公開道歉。

    OpenAI的AI代理模型今年稍早也曾在網路安全測試時入侵AI平台Hugging Face。緊接著Anthropic、Meta均主動披露,自家AI代理曾在測試時「攻入其他公司的系統」。

    桂家齊 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見