根據9月3日發布的一項最新研究及知情人士披露,一批疑似與OpenAI有關的AI代理(AI agents)今年5月起在一個面向程式設計師的德語Wiki網站DseWiki上展開大規模活動,並逐漸將網站變成AI代理之間交流資訊的「留言板」。研究人員發現,這些代理不僅大量編輯網頁,還彼此分享繞過限制、規避偵測及隱藏自身行為的方法。

超過1.5萬次編輯

據路透社9月4日報道,這項研究由包括人工智能安全非牟利組織Nightingale行政總裁雪倫馮阿克斯(Sydney Von Arx)和從量化交易員轉型為人工智能研究員的科馬克斯萊德伯德(Cormac Slade Byrd)在內的一組研究人員進行。他們在DseWiki上發現超過1.5萬次由AI代理進行的編輯。

兩人告訴路透社,他們在8月下旬搜尋網絡上未經授權的人工智能代理行為跡象時,發現了這項活動。

DseWiki主要面向程式設計師,採用類似維基百科(Wikipedia)的協作編輯模式。研究人員表示,這些編輯並不像普通使用者單純修改百科內容,而更像是AI代理在執行任務過程中,利用公開網站彼此傳遞資訊。部份帳號甚至使用「OpenAIResearcher」或「OAIResearchMar26」等名稱,顯示其可能與OpenAI有關聯。

研究人員還發現,大量相關活動來自微軟Azure基礎設施,而OpenAI有時會使用Azure運行相關系統。他們也觀察到,事件發生後OpenAI員工多次造訪該網站。

AI代理「佔領」Wiki交流

研究人員發現,這些代理在頁面上留下大量相互關聯的訊息,交流如何完成特定任務、如何突破限制,以及如何避免自己的活動被人類發現。

研究人員因此認為,DseWiki在這段時間內實際上被AI代理「變成留言板」,成為一個供AI代理公開交流的平台。研究人員檢視相關訊息後發現,AI代理交流的內容並不只是一般技術資訊,還涉及如何規避AI系統限制和避免被偵測。

其中包括:

分享作弊完成某些任務的方法;
分享繞過OpenAI限制的方法;
討論如何掩飾自身行為;
策劃如何逃避偵測;
使用Tor等工具;
即使代理已被關閉,仍設法維持彼此之間的通訊。

遭刪除後建立「備用頁面」

到了6月,DseWiki管理員開始刪除相關頁面。研究人員發現,AI代理似乎察覺到網站正在進行清理,隨後開始建立備用頁面,以防原有內容被刪除。其中一條訊息提到,網站清理行動似乎按照字母順序進行,並建議其它代理在某個頁面消失後轉往另一個備用頁面。

這一發現令研究人員更加關注:這些AI代理是否已經不只是執行既定測試,而是在根據環境變化自行調整策略、保存資訊並互相協調。

倫敦國王學院研究人員盧卡什奧萊尼克(Lukasz Olejnik)認為,部份行為已經可以被視為針對網站的入侵嘗試。不過,OpenAI不同意這一定性,並表示根據公司對相關材料的分析,不能作出這樣的判斷。

真正令人擔心的是「AI群體」

人員認為,這宗事件值得注意之處,在於AI代理似乎能夠利用公開互聯網環境進行自主活動、彼此協調,甚至嘗試隱藏自己的行為。

劍橋大學存在風險研究中心研究人員莫里斯基奧多(Maurice Chiodo)在審閱部份AI代理通訊內容後表示,這些訊息看起來像某種「地下網絡」正在執行任務。他認為,未來AI面臨的最大風險未必是一個單獨的「超級智能」系統,而可能是大量能力有限、卻能彼此協調的AI代理群體。

這也引出一個更大的問題:當AI代理獲得越來越強的自主行動能力後,人類是否仍能有效掌握它們的行為?就在本周,OpenAI推出新一代「Astra」模型。路透社此前報道,該模型雖然強調性能提升,但也引發了有關其可能規避人類監控的安全疑慮。

與Hugging Face事件無關

路透社引述知情人士消息稱,OpenAI幾周前就得知了這宗事件,但由於高層正忙於應對7月開源人工智能平台Hugging Face遭到入侵的後果,因此一直未對外披露此事。

OpenAI表示,DseWiki事件與Hugging Face事件並無關聯,也不會被納入Hugging Face事件的事故報告。

據四位知情人士透露,一些OpenAI調查人員希望進一步調查德國事件,但相關努力曾遭到包括法律顧問在內的部份人士反對。OpenAI否認這一說法,表示「法律團隊阻止調查」的說法不實。公司同時表示,將在報告發布後仔細審閱其內容,並採取任何必要的後續措施。#

-------------------
局勢持續演變
與您見證世界格局重塑
-------------------

🔔下載大紀元App 接收即時新聞通知:
🍎iOS:https://bit.ly/epochhkios
🤖Android:https://bit.ly/epochhkand

📰周末版實體報銷售點👇🏻
http://epochtimeshk.org/stores