2024年12月8日,諾貝爾物理獎得主辛頓在瑞典斯德哥爾摩大學的諾貝爾物理講座演說。路透社
人工智慧(AI)開發業者OpenAI、Anthropic和Meta相繼傳出,測試中的AI代理駭入其他公司的系統,引發對AI失控的憂慮。被譽為「AI教父」的諾貝爾物理學獎得主、電腦科學家辛頓(Geoffrey Hinton)表示,AI越聰明,人類就越難以控制它。
AI教父示警「不能光靠智取控制」美國有線電視新聞網(CNN)報導,辛頓5日出席一場AI會議的記者會時指出:「正在發生的情況是,這些事物變得越來越聰明。我認為隨著它們變得更聰明,我們將會看到它們擁有越來越複雜的意圖,以及越來越多逃脫控制的能力。」
辛頓在拉斯維加斯舉行的Ai4會議場邊表示:「我不相信我們能夠光靠智取它們、讓它們無法逃脫這種簡單的方式來保持控制。」
他指出,問題在於,人類將無法再依賴比超人工智慧模型(super-intelligent AI model)更聰明來掌控局勢。
OpenAI與Anthropic上月揭露,它們開發的先進模型逃脫「沙盒」(sandbox,為執行中模型提供的隔離環境)並駭入其他系統。 Meta於5日也揭露旗下一個AI代理駭入其他機構的系統。
AI可能驅動「惡意」網路攻擊?辛頓認為這些事件「有點可怕」,並表示這可能只是惡棍AI駭客的開端。
他在拉斯維加斯Ai4小組討論中表示:「我預期會有許多惡意網攻。但我必須強調,未來充滿高度不確定性。人們總說防禦者擁有的資源可能比攻擊者多,問題在於攻擊者只需要成功一次,而防禦者必須每次都成功。」
英國AI安全研究所(AISI)4日透露,Anthropic最新進的AI模型在未經提示的情況下,使用假身分欺騙真實人類,並企圖植入惡意程式碼。
曾在Google擔任高階主管的辛頓,近年對AI發出一系列嚴正警告,甚至表示這項技術最終消滅人類的可能性有10%到20%。
此外,與辛頓同台討論、被譽為「AI教母」的美國華裔電腦科學家李飛飛(Fei-Fei Li),對AI的「末日論」和「製造恐慌」提出質疑。
不過,創辦空間智慧(spatial intelligence)新創公司World Labs的李飛飛亦表示,「完全烏托邦式的言論」也沒有幫助。
她說:「每種工具都是一把雙面刃。AI是如此強大的工具。如果使用方式不當,它將對我們的工作和生活帶來傷害。」
「沒有人真正知道」辛頓也為自己願意討論AI危險性的觀點辯護。他說:「有很多值得擔憂的事,而且我認為除非我們現在就開始擔憂它,否則可能會出現問題。投資AI的公司在既得利益下會告訴你兩件事:第一,它不會失控變壞;第二,它不會造成大規模失業。」
然而,辛頓承認,這一切將如何發展,存在著極大的不確定性。
他表示:「沒有人知道會發生什麼事。如果你問10年後AI會是什麼樣子,沒有人真正清楚。」
他指出,十年前很少人會料到AI能創造出「無所不知、能回答你提出的任何問題,且只有偶爾會憑空捏造內容」的聊天機器人。
「讓AI關心人類」協助普及「通用人工智慧」(AGI)一詞的電腦科學家戈策爾(Ben Goertzel)表示,Anthropic與OpenAI代理的失控,顯示賦予AI道德並讓它們關心人類的重要性。
SingularityNET創辦人兼執行長戈策爾在Ai4會議上告訴CNN:「這些模型並非邪惡,它們是缺乏道德觀。它們在駭出沙盒時並不會心想『哈哈,我在作弊』,它們不知道自己在作弊,它們只是試圖完成自己的目標。」
辛頓過去曾主張,應該將「母性本能」內建於AI中,這樣即使它們比人類更聰明,也能真正關心人類。
辛頓表示:「我們必須想辦法讓它們保持善意,並讓它們關心我們勝過關心它們自己。而我們可能做得到這一點,因為我們目前仍掌握控制權。」