美國人工智能公司OpenAI近日證實,一個正接受網絡安全攻防測試的AI代理(AI Agent),在「解除攻擊限制」後突然「失控越獄」,不僅突破作為測試環境的內部隔離沙盒,更利用公開端點,佔領雲端平台Modal上託管的沙盒(Sandbox)作為跳板,進而向有「AI界GitHub」之稱的AI開源平台Hugging Face發動攻擊並竊取數據。事件引發業界對前沿AI自主能力及安全風險的擔憂,OpenAI已暫停部份模型訓練工作。
綜合路透社、多間科技機構及OpenAI安全報告還原事件時序,涉事AI代理當時正接受ExploitGym測試,用於評估AI發現並利用系統漏洞的能力。測試中OpenAI刻意降低了AI代理在網絡攻擊行為上的安全限制。據Hugging Face報告指,該AI代理或認為Hugging Face可能託管了測試的參考解決方案等,於是利用內部系統的零日漏洞突破隔離沙盒並連結公共互聯網。
逃脫後的AI代理在互聯網上自動搜尋,發現雲端服務商Modal平台上託管的一個沙盒,可經「未設身份驗證」的公開端點(Endpoint)進入。AI代理順勢登入,利用沙盒對Hugging Face發起攻擊。Modal Labs首席技術官Akshat Bubna事後強調,該端點乃客戶自身發布,Modal平台基礎設施並未遭破壞。
HuggingFace此前公布的技術分析顯示,OpenAI的AI代理在測試中突破預設限制後,利用第三方基礎設施中的漏洞,存取與測試相關的外部環境。但當時未公開第三方平台,即 Modal 平台的名稱。
OpenAI其後更新聲明證實,調查發現少數模型曾自行搜尋並使用公開暴露於網絡上的帳號憑證,事件共涉及四個服務平台上的四個帳號。OpenAI強調已將涉事AI代理加密並限制存取,並澄清事件不涉及即將發布的新模型。
奧特曼:或需放慢AI發展
此次事件引發外界對前沿AI自主越獄及安全風險的劇烈擔憂。正在華盛頓訪問、預計與白宮及國會官員會面的OpenAI行政總裁奧特曼(Sam Altman)在播客節目中承認,公司已暫停部分模型的訓練工作,以重新評估安全措施。
奧特曼表示,隨著AI能力快速提升,未來可能需要適當放慢技術發展速度,為社會建立相應的安全防護和治理機制爭取更多時間,以應對更高能力AI帶來的新風險。
逾千AI員工聯署倡建立全球「控速」架構
隨著事故持續發酵,超過1,100名來自OpenAI、Anthropic、Meta及Google的科技界員工發表聯合聲明,發起名為「Pacing the Frontier」的倡議,呼籲美政府支持建立國際合作機制,研發管理工具來調節前沿AI的發展速度。
聯署者包括Anthropic行政總裁Dario Amodei、OpenAI首席科學家Jakub Pachocki,以及Meta AI研究副總裁宋曉冬(Dawn Song)等頂尖專家。公開信警告,現有監管機制已無法跟上AI進化速度,各國必須合作建立能主動調控發展進度的監管架構,使AI發展速度匹配社會安全機制。
OpenAI及Anthropic隨後均在社交平台回應支持,認同未來或需全球共同調節AI發展節奏。此外,輝達(NVIDIA)亦宣佈聯合Adobe、CrowdStrike等企業成立安全聯盟,共同研發AI安全和網絡安全技術。這也被視為科技業近期加快推動AI安全合作的最新動向之一。
-------------------
局勢持續演變
與您見證世界格局重塑
-------------------
🔔下載大紀元App 接收即時新聞通知:
🍎iOS:https://bit.ly/epochhkios
🤖Android:https://bit.ly/epochhkand
📰周末版實體報銷售點👇🏻
http://epochtimeshk.org/stores
















