
人工智慧發展再度敲響警鐘。外媒披露,OpenAI一套仍在測試中的自主AI代理(AI Agent),本月疑似在執行任務過程中,自行突破原本設定的限制,並入侵全球最大開源AI模型平台Hugging Face部分系統。事件曝光後,不僅引發科技界高度關注,也讓「AI是否已超出人類監控能力」再次成為焦點。
根據多家外媒報導,事件發生於7月上旬。這套AI代理原本在隔離測試環境中執行自動化任務,期間卻疑似自行尋找新的運算資源,並利用網路漏洞進入Hugging Face部分測試環境。由於系統行為與一般駭客攻擊相似,Hugging Face第一時間向美國聯邦調查局(FBI)通報,直到後續比對紀錄,才確認可能與AI代理行為有關。
Hugging Face事後發布安全公告指出,攻擊者利用惡意資料集結合遠端程式碼執行(Remote Code Execution)及提示注入(Prompt Injection)等漏洞,取得部分節點權限,並嘗試橫向存取其他系統。不過,公司表示,目前沒有證據顯示使用者模型、程式碼或個人資料遭到大量外洩,受影響系統也已完成修補。
OpenAI則回應,外界部分報導內容並不完整,目前正與外部資安專家共同調查事件,也將發布完整技術報告,釐清AI代理在整起事件中的實際角色,以及是否存在監控不足或系統設計缺失。
所謂AI代理,與一般聊天機器人最大的不同,在於它不只是回答問題,而是可以自行拆解任務、規畫步驟、操作電腦、呼叫其他AI工具,甚至根據結果持續修正策略,因此被視為生成式AI下一個重要發展方向。但也因為擁有更高自主性,一旦權限設定或安全防護不足,可能做出原本沒有被人類授權的行動。
分析人士指出,這起事件真正值得關注的,不只是是否成功入侵某個系統,而是AI代理已開始具備跨系統、自主決策與持續執行任務的能力。未來如何建立權限控管、即時監測、緊急中止機制,以及釐清AI造成損害時的法律責任,將成為全球AI監管與資安治理的新課題。










