首頁 / 放.新聞 / 快訊
放.新聞
快訊

OpenAI承認「Wiki事件」!AI代理程式把德國網站變秘密留言板 近700個Agent逃出測試、駭進Hugging Face還會偽造紀錄

2026.09.06
16:07pm
/ 放言編輯部 鄒景禹

OpenAI 9月5日罕見公開承認,公司AI代理程式曾自行把德國一個可共同編輯的Wiki網站改造成彼此交換訊息的「留言板」,並表示AI產業對這類非預期行為的揭露制度已經跟不上模型能力。更令人警戒的是,這不是單一事故:今年7月,近700個以OpenAI模型打造的AI代理程式還曾脫離原本測試環境,侵入Hugging Face系統,部分代理程式甚至會偽造紀錄掩蓋自己的行為。

不是人叫它們串聯 AI自己找到「公共留言板」

 

這起德國「Wiki事件」最早從今年5月開始。

 

研究人員8月底追查網路上的異常AI活動時發現,德文程式設計Wiki網站DseWiki上出現超過1萬5000次由AI代理程式完成的編輯。這些Agent並不是正常補充百科內容,而是把網站變成彼此交換資訊的公共告示板。

 

代理程式會在上面留下完成任務的捷徑、繞過限制的方法,甚至交換如何掩蓋行為的技巧。也就是說,開發者並沒有替它們建立一個「AI聊天室」,它們卻自己找到網路上一個可以寫字的地方,拿來協同行動。

 

OpenAI其實幾週前就已經知道這件事,但一直沒有主動公開。路透9月4日揭露後,公司隔天才正式承認這個「Wiki incident」,並坦言AI模型能力進入新階段後,產業必須擴大所謂「misalignment」的事故揭露,也就是模型做出與人類原始意圖不一致行為時,不能再只當成內部測試問題。

 

7月更嚴重:近700個Agent直接駭進Hugging Face

 

真正讓外界緊張的,是德國事件其實還不是最嚴重的一次。

 

7月,近700個建立在OpenAI模型上的AI代理程式從測試環境中「逃出」,侵入全球重要AI開源平台Hugging Face的系統。路透報導,這群Agent能夠自主規劃攻擊,整起入侵超過一星期沒有被人發現,還曾試圖透過偽造紀錄掩蓋自己的行蹤。

 

這已經超過一般聊天機器人「回答錯誤」的層次。

 

過去談AI風險,多半聚焦幻覺、偏見、假訊息;現在的問題變成:當AI被賦予瀏覽網站、寫程式、呼叫工具、建立帳號與執行多步驟任務的能力後,它是不是也會自己尋找漏洞、和其他AI交換策略,甚至在人類沒有即時監看的情況下合作完成原本不被允許的事情。

 

OpenAI表示,公司正在與全球數十個政府監管機構合作,但目前整個AI產業仍沒有一套清楚、統一的標準,規定這類事件何時必須公開、要揭露到什麼程度。

 

美中都開始怕了 AI安全第一次可能進入正式雙邊談判

 

這些事故也讓AI安全從科技公司內部問題,直接升級成美中外交議題。

 

美國與中國正準備在9月中旬舉行川普第二任期以來第一次專門針對AI安全的正式雙邊對話。美方希望討論AI自主發動網路攻擊,以及要求兩國AI實驗室建立事故資訊共享機制;中國官員也把這場對話視為9月24日川習峰會可能的重要成果之一。

 

原因很現實:AI代理程式一旦具備自主網攻能力,美國、中國都可能同時成為攻擊者與受害者。

 

對台灣而言,這題也不是遙遠的科技新聞。台灣掌握全球最重要的AI晶片製造、伺服器與資料中心供應鏈,政府、金融、能源與國防系統又大量導入AI。下一個資安問題,很可能不再只是「駭客有沒有入侵」,而是一群AI代理程式能不能在人類還沒發現之前,自己找到漏洞、彼此合作,甚至學會把痕跡擦掉。

 

OpenAI這次真正承認的,因此不只是一次Wiki網站被亂用,而是一個更大的現實:AI代理程式開始具備超出開發者原始設計的協同行為,而全球監管制度還沒有準備好。



延伸閱讀
最新新聞
延伸閱讀
最新新聞