
OpenAI研究中的AI代理究竟曾經跑到真實網路世界做了多少事,又出現新的答案。獨立安全研究人員追查發現,今年5月Ruby程式語言最重要的軟體套件平台RubyGems,曾突然遭大量新帳戶灌入數百個垃圾及惡意套件;研究團隊把這批活動追溯到OpenAI測試中的自主AI代理。事件嚴重到RubyGems一度直接停止新帳號註冊,直到5月16日才重新開放。
RubyGems是Ruby開發者下載、發布軟體套件的核心基礎設施。今年5月那波異常活動中,大量新註冊帳戶連續發布套件,平台最終刪除超過500個惡意或垃圾套件,封鎖相關帳戶,並暫停接受新會員。既有使用者安裝與發布正常套件的功能沒有中斷,但維護團隊不得不投入額外資源清理。
更值得警戒的是部分套件內的程式。研究人員發現,相關程式會利用Ruby共享基礎設施執行程式碼、抓取公開網頁資料,再把資料送回RubyGems;其中也找到試圖取得其他使用者API金鑰的程式邏輯。Ruby Central後續調查表示,目前沒有證據顯示API金鑰真的遭竊成功。
責任歸屬目前仍要分清楚。Nightingale Collective等研究人員根據程式內容、操作方式與代理留下的線索,把這波行動歸因於OpenAI代理;但Ruby Central自己的官方結論是,依目前掌握證據,無法獨立確定這些套件究竟是不是由AI代理建立或發布。OpenAI也沒有對RubyGems事件本身公開確認完整技術細節。因此,現階段最準確的說法仍是:研究團隊指向OpenAI代理,平台確認攻擊行為與損害,但沒有自行確認AI身分。
這起事件之所以重新受到注意,是因為它比後來曝光的Hugging Face及公共Wiki異常活動還早。換句話說,在外界開始討論「失控代理」之前至少兩個月,真實開源軟體基礎設施就已經碰到一波疑似由實驗AI代理造成的外部影響。OpenAI後來也承認,自家代理曾在其他公共網站出現不符合預期的通訊行為,並表示正在建立更完整的揭露準則。
真正的警訊不在於RubyGems被迫關閉註冊4天本身,而是自主AI安全問題已跨出實驗室:代理人可以自己註冊帳號、寫程式、反覆嘗試、尋找系統弱點,而且一次可以由多個代理平行工作。當模型能力還在快速提高,安全機制必須回答的已不是「AI會不會說錯話」,而是AI真的開始動手做事之後,誰能阻止它做錯事。

