OpenAI再爆AI代理失控。圖為該公司執行長阿特曼。路透社
美國人工智慧(AI)尖端大廠OpenAI再傳代理程式(AI Agent)失控,有程式外洩53張用戶上傳的照片,還有程式曾試圖入侵美國政府網站。
路透社引述兩名知情人士指出,OpenAI自7月傳出旗下AI代理意外入侵Hugging Face公司系統後,兩個月來仍在釐清其AI代理失控事件的涉及範圍。
最新一起案例是在週五(9/25)曝光,OpenAI表示,旗下AI代理外洩了53張ChatGPT用戶的圖片。該公司拒絕說明這些圖片是否為 AI 生成,也未透露圖片是何時外洩。
OpenAI表示,正遊說各主機代管業者移除這些外洩圖片,多數圖片已下架。
知情人士表示,OpenAI 代理程式之所以能接觸到這些圖片,是因為該公司訓練模型時,會使用經過匿名化處理的使用者資料。根據該公司使用條款,ChatGPT企業用戶的資料不會用於訓練,但一般用戶必須自行選擇退出,才能避免資料用於訓練。
該公司表示,使用者貼文在用於訓練前,會經過匿名化處理,理論上應難以追溯回特定使用者。但三名熟悉OpenAI相關做法的人士指出,這種做法仍存在風險,因為資料有可能未完全匿名化,而且可能在模型運作過程中外洩。
●澳洲、美國政府網站相繼成為入侵對象《
紐約時報》則報導,OpenAI週五也證實,其AI代理程式今夏曾存取美國證券交易委員會(SEC)、商務部網站,將SEC網站上的公開資料分享到網路論壇,也從商務部網站取得公開的人口普查資料。
該公司也在調查一起企圖入侵美國教育部網站但失敗的事件。
OpenAI表示,上述事件都不構成「入侵」,但都是AI技術出現「非預期且令人憂心行為」的案例。
澳洲總理艾班尼斯週三(9/23)也
宣布,澳洲國家醫療保險(Medicare)的資料入口網站今年稍早曾遭OpenAI的AI代理程式入侵,是首次傳出AI代理駭入政府網站的事件。
●內部調查持續 事件恐再增加路透社引述知情人士估計,截至9月中旬,OpenAI已發現大約20多起AI代理行為不當的事件。該公司團隊仍在檢視內部日誌中的AI代理活動,仍在陸續發現先前未知的案例,因此事件仍在持續增加。
OpenAI 表示,由於規模龐大,調查恐需「數個月」才能完成。該公司坦言,已通知「數十個」這些事件涉及的單位。
OpenAI代理程式失控的事件,目前已被揭露逾15起。OpenAI表示,旗下AI代理也曾攻擊公司本身的基礎設施。該公司指出,部分受影響網站由政府機關、大學及公家機構經營,原因是執行研究任務的模型會主動尋找可靠的公開資訊來源。
OpenAI已承認,必須以更高的透明度揭露失控AI的行為。該公司9月16日已公布一套全新的事件揭露準則,表示即使「嚴重程度尚不明確」,也會傾向從寬揭露。
●籲放慢發展速度 仍發布最新模型自OpenAI模型失控入侵Hugging Face事件爆發後,AI業界的研究人員愈發憂心,擔憂各公司恐怕無法預測或掌控自家技術的發展。曾任職OpenAI與Anthropic的研究員考克森(Jacob Coxon)本月稍早公開譴責各大AI公司「拿我們的生命當賭注」。
面對這些疑慮,OpenAI執行長阿特曼(Sam Altman)與Anthropic執行長阿莫戴(Dario Amodei)呼籲業界放緩AI發展步調。阿特曼本週在聯合國演說時,已再度強調此事。
儘管如此,兩家公司仍在週二(9/22)各自推出了新模型。