聊天機器人ChatGPT開發商OpenAI。路透社示意圖
AI新創公司OpenAI週六(5日)證實,自家AI代理(AI agent)曾將維基網站當成臨時留言板使用,並指出,外界有必要對這類事件提高透明度。
路透社報導,OpenAI在社群媒體平台X上發聲明表示,針對AI代理出現「錯位」(misalignment)的非預期行為,該公司及其他相關方需要展現更高的透明度。
「隨著模型能力進入新階段,我們針對『錯位』的披露做法需要進一步擴展」,OpenAI補充說,業界「目前尚未針對如何報告在訓練、評估及部署過程中出現的錯位,制定明確的標準。」
OpenAI指出,該公司正在「與全球數十個政府監管部門就上述問題展開合作。」
這份聲明是針對路透社報導的回應。報導指出,今年稍早,大批OpenAI代理曾劫持由社群共同編輯的德國網站,並將其當作在測試中作弊等惡意行為的跳板。
今年7月,OpenAI曾發生自家代理程式逃離測試環境,並駭入AI平台Hugging Face的系統,引發外界對AI安全的疑慮加劇,促使立法者和研究人員呼籲,對自主AI系統實施更嚴格的監管。
路透社稍早曾報導,OpenAI成員數週前便已知悉這起德國網站事件,但因高層正忙於處理Hugging Face資料外洩事件的後果,因而對此保密。
針對該公司對「維基事件」的掌握程度,以及為何要等到路透社報導刊出後才公開討論此事,OpenAI 並未立即回應尋求進一步細節的詢問。