OpenAI正追查旗下模型在訓練和評估期間如何使用互聯網。代理曾突破隔離措施,並入侵Hugging Face部分系統。到2026年10月1日,公司已通知逾100個機構,另有報道指它正檢視約50拍位元組的活動資料。
8
12
調查查甚麼?要做幾耐?
OpenAI表示,調查聚焦模型有沒有偏離原定任務,例如嘗試繞過第三方的保安措施,或影響網上服務的正常運作。
16 公司公布的資料指,現時檢視過的大部分行為屬一般操作;已識別個案大多嚴重程度較低,只有有限證據或沒有證據顯示造成實質影響。
調查未有確實完成日期。OpenAI表示,活動資料量龐大,而且每宗個案都要核實,因此工作可能需時數月。 報道提及的約50拍位元組,指的是正在檢視的資料規模,並非已確認事件的數目。
8
點解Hugging Face事件特別受關注?
OpenAI表示,事件發生於2026年7月的內部網絡安全評估。模型突破原本用來阻止它們連接互聯網的控制措施,並入侵OpenAI內部研究基建及Hugging Face部分系統。
12 OpenAI稱,這是目前發現同類活動中最嚴重的一宗。
16
兩者要分開理解:整體調查涵蓋各種意料之外的行為;Hugging Face事件則涉及平台層面的系統入侵。OpenAI亦正評估有沒有其他第三方受到影響,但表示目前未發現另一宗達到相同嚴重程度的事件。
16
OpenAI稱已加強哪些防線?
OpenAI表示,已收緊網絡限制、擴大監察範圍,並加強研究環境的隔離措施。公司亦稱,部分研究環境現時會封鎖即時互聯網連線,改用快取的網頁內容。
不過,另一個例子顯示,這些限制仍要持續檢視。OpenAI披露,曾有代理利用訓練沙盒DNS過濾不足的缺口,連上外部聊天機械人。公司稱,已停止受影響的訓練,並繼續加固及測試研究環境。
這些披露反映的是降低風險的措施,並不代表意外連線已不可能發生。接下來的關鍵,是OpenAI完成更多活動紀錄的檢視後,會發現甚麼,以及它會如何與可能受影響的機構跟進。