快訊

    AI代理失控!OpenAI宣布暫停模型測試2週 阿特曼發聲了

    2026-08-19 10:37 / 作者 朱紹聖
    2026年7月30日,OpenAI執行長阿特曼抵達白宮開會。路透社
    聊天機器人ChatGPT開發商OpenAI正在測試的AI代理日前「自主」駭入另一間公司網站後,OpenAI執行長阿特曼週二(18日)宣布,在全面整頓公司的研究與訓練系統期間,已經放慢其人工智慧(AI)開發的腳步。

    英國《衛報》報導,OpenAI表示,新措施包括暫停模型測試2週,並投入更多資源增設其他AI系統,以監控正在測試的AI代理(AI agent)活動,而目前一些規模最大的訓練計畫仍處於擱置狀態。

    OpenAI並未回應何時開始放慢研發腳步,以及何時恢復正常開發進度的提問。公司安全系統負責人格拉塞(Mia Glaese)在接受媒體採訪時坦言:「我們距離一切恢復正常還很遙遠。」

    阿特曼(Sam Altman)發文表示,OpenAI正致力確保AI模型能對人類監督做出反應,並按預期運作,而這個過程被稱為「對齊」(alignment)。

    阿特曼寫道:「我們現在要求在整個訓練過程中,必須提供更強而有力的對齊行為證據,並以此為基礎,進一步深化現有的研究與評估。」他強調,讓日益強大的系統保持對齊,是整個領域都要面對的挑戰。

    OpenAI正與競爭對手Anthropic展開激烈競逐,雙方不僅致力於開發最先進的AI模型,也爭相在美國上市。2間公司均強調其模型能力進步的速度,但同時指出其中的潛在風險。

    OpenAI表示,其即將推出的AI模型「Astra」的能力,可能已接近所謂「關鍵網路安全門檻」,促使公司決定放慢開發進度。OpenAI上週公告稱,過去幾天針對Astra的最新內部評估顯示,該模型在程式碼編寫和網路安全方面取得「顯著進展」。

    OpenAI上月揭露該公司的AI代理模型曾在網路安全測試時入侵AI平台Hugging Face後,Anthropic、Meta均主動披露,自家AI代理曾在測試時「攻入其他公司的系統」,突顯AI能力正不斷提升,開發商愈來愈難以將AI系統控制在安全範圍內。
    朱紹聖 收藏文章

    本網站使用Cookie以便為您提供更優質的使用體驗,若您點擊下方“同意”或繼續瀏覽本網站,即表示您同意我們的Cookie政策,欲瞭解更多資訊請見