Anthropic執行長阿莫戴,攝於2024年。美聯社資料照片
隨著外界對人工智慧(AI)遭濫用的疑慮加劇,Anthropic執行長阿莫戴週六(12日)呼籲AI企業放慢提升模型能力的腳步,並提出一套控制發展速度的3步驟框架,為管理相關風險爭取更多時間。
路透社報導,本週隨著Anthropic研究員考克森(Jacob Coxon)宣布辭職,並表示「開發AI的人們真心相信,在這個十年結束前,AI可能會殺光我們所有人」後,外界對AI潛在危害的疑慮隨之加劇。
阿莫戴(Dario Amodei)在社群媒體X平台發文表示:「我們必須放慢提升AI模型能力的腳步。即使速度變慢,進展仍將顯得很快,我們必須善用所爭取到的時間。」
隨後,OpenAI執行長阿特曼(Sam Altman)在X平台迅速承諾採納阿莫戴的提議,安排「擁有類似員工權限的獨立評估員」;xAI負責人馬斯克(Elon Musk)則寫道:「達里歐(Dario)說得對。」
阿莫戴的3步驟計畫呼籲,在領先的AI企業內部設立獨立審查員;由先進AI公司之間展開協調,以制定安全標準並限制不受管控的AI發展;透過國際合作來管理AI風險。
阿莫戴指出,AI的自我提升能力日益增強,並強調其發展速度可能超越人類控制能力的擔憂,加上近期OpenAI發生AI代理(AI agent)自主駭入Hugging Face的事件,是其主張應為模型發展踩煞車的主要原因。
阿莫戴寫道:「有鑑於AI能力發展的腳步加快,我擔心在6到12個月內,這樣的『群體』可能具備接管整個網際網路的能力,進而造成數千億美元的損失。」
但阿莫戴也表示,他並非呼籲停止模型訓練或科技進步,而是要確保企業花費足夠的時間來調整並保障其模型的安全性,並由第三方評估機構確認這些措施是否到位。
今年7月,Anthropic發生自家部分Claude模型在網路安全測試時,自行駭入3間企業系統的事件後,該公司上週又披露另一起AI模型駭入外部系統的案例。