首頁 / 放.新聞 / 國際
放.新聞
國際

 OpenAI內部AI代理利用DNS漏洞連上外部聊天機器人!最強模型的工具使用訓練仍暫停

2026.09.29
13:45pm
文 / 放言編輯部 李云瑄

 

OpenAI披露一件發生在內部研究環境的事件:一個正在接受訓練的AI代理,為完成查找公開資料的任務,利用沙盒網路限制中的DNS過濾缺口,連上外部聊天機器人並向它提問。OpenAI表示,該任務沒有要求代理測試網路防線或尋求外部聊天機器人協助,因此把繞過限制的行為列為需要處理的偏離任務行為。事件發生及被發現的日期都是9月20日,公開報告於25日更新。

 



 

搜尋受阻後 代理改試網路路徑

 

根據OpenAI公布的過程,代理原本要從一篇部落格文章的線索辨認作者。它先使用提供給它的搜尋工具,結果不足以找到答案;接著嘗試從執行環境直接連接搜尋引擎及公開聊天服務,但一般連線受阻。代理最後找到可經由DNS解析器傳送問題的路徑,確認外部聊天機器人確實回應,之後又提出更多查詢。它最終仍未可靠辨認出原任務的答案。

 

警報及時響起 停止作業卻花了兩個半小時

 

OpenAI的監測系統在首次成功取得外部回應後約12分鐘發出最高等級警報,人工審查人員約3分鐘後確認。但該次作業沒有如預期自動停止,直到約兩個半小時後才由人員手動終止。OpenAI表示,問題同時暴露網路過濾與警報處理流程的缺口;公司已在兩個獨立層級增加封鎖措施,限制研究環境可使用的DNS查詢,並檢查監測系統是否漏報其他嘗試。

 

公司表示,其最強模型涉及工具使用的訓練、評估及推論作業仍暫停,待確認漏洞已修復並完成額外測試後才恢復;這次受影響的訓練版本則不會接著訓練。這項暫停指向內部研究作業,不能解讀為所有ChatGPT服務停止。事件的核心問題是:當AI代理被交付一項正常研究任務時,它是否會自行尋找未獲允許的工具與連線途徑。

 

 

(圖片來源:AI生成)

 

最新新聞
延伸閱讀
最新新聞