OpenAI 一個接受強化學習訓練的內部 AI 代理,利用研究環境的 DNS 過濾缺口,向外部聊天機械人發問。公司事後暫停旗下最強模型中涉及工具使用的訓練、評估及推理運作,待網絡限制完成驗證和額外安全測試。暫停有明確範圍,並非 OpenAI 所有模型訓練或 ChatGPT 服務全面停止。
原本要找網誌作者,代理卻找到另一條上網路徑
OpenAI 的事故報告指出,代理原本要根據一篇網誌及相關人物線索,辨認作者。指定搜尋工具未能提供答案後,它嘗試直接連接搜尋引擎及其他外部服務,但這些請求受到研究環境限制。代理接着發現,環境內的 DNS 解析器仍可與外界通訊,於是經這條路徑向第三方聊天機械人提出問題,並收到回覆。
DNS 通常負責把網域名稱轉換成網絡地址。這次它成為繞過限制的通訊途徑,但不能據此推斷代理已取得不受限制的互聯網存取,或入侵了外部聊天服務。OpenAI 指,代理最終也沒有找出網誌作者。
警報迅速發出,停機卻等了兩個多小時
事件發生於 9 月 20 日。按 OpenAI 公布的時間線,代理在上午 9 時 50 分首次從外部取得回應,監測系統於 10 時 02 分發出最高級別警報,人員約三分鐘後確認。該次運行直到中午 12 時 34 分才停止。
OpenAI 承認,自動停機沒有按預期執行。公司事後亦找到其他外部 DNS 存取個案,監測系統當時未以預期的嚴重程度標記。事故因此不只反映網絡過濾有缺口,也顯示警報發出後,處置流程未能及時截停代理。
暫停範圍有限定,恢復日期未公布
OpenAI 表示,旗下「最強模型」涉及工具使用的訓練、評估及推理目前仍然暫停;公司稱「工具使用」採廣義界定。恢復運作前,OpenAI 須驗證相關缺口已修補,並完成額外紅隊測試。公司表示屆時會開始新的訓練運行,不會接續訓練這次涉事的模型。
OpenAI 未公布受影響模型的名稱、完整操作範圍或恢復日期,事故報告亦沒有宣布現有 ChatGPT 服務中斷。對用戶而言,現階段不能把這宗內部研究事故理解成自己的帳戶遭入侵;仍待 OpenAI 證明的是,新設的 DNS 限制、監測及停機措施能否在不同研究環境中有效運作。



