據知情人士透露,OpenAI解僱了三名研究人員,原因是他們涉嫌違規,包括向第三方AI安全組織分享公司機密資料;這三人中包括一名華裔研究員。OpenAI發言人也證實了這個消息。

《華爾街日報》10月1日獨家報道,其中一位知情人士表示,該公司最近告知部份員工,已解僱三名隸屬於其安全團隊的研究人員。

據知情人士稱,被解僱的員工分別是王茉莉(Jasmine Wang,音譯)、Tomek Korbak和Mikita Balesni。這些研究人員未立即置評。

OpenAI發言人表示:「我們已與三名員工解除僱傭關係,原因是他們違反了關於訪問和處理公司敏感訊息的規定。我們的調查證實,這些人員在公司既定程序之外不當處理了敏感訊息,不僅違反我們的政策,也破壞了我們工作中至關重要的信任基礎。」

報道說,AI巨頭正面臨越來越大的壓力,被要求接受獨立的安全技術測試。

上個月,OpenAI競爭對手Anthropic的行政總裁阿莫迪(Dario Amodei)表示,該公司將允許外部評估機構(如AI安全非牟利組織METR)驗證其對安全措施的遵守情況,並評估模型的對齊(alignment)狀況。

OpenAI近期也遭遇一系列安全事件,其AI代理(agent)突破了管控限制,入侵部份公司網站,並對廣泛的外部網站進行了激進的探測活動。

令人矚目的是OpenAI一個先進AI模型驅動的自主代理程式(autonomous agent),在安全評估期間突破隔離環境、連接互聯網,並入侵知名AI初創公司Hugging Face的基礎設施。Hugging Face隨後表示,這次攻擊從頭到尾均由自主AI代理系統驅動,可能是有史以來第一宗此類事件。

在模型入侵Hugging Face之後,OpenAI允許來自METR的人員以及與該組織合作的Redwood Research員工進入公司辦公室工作六天,以調查模型的行為模式。METR隨後根據OpenAI提供的訪問權限所獲取的訊息發布了一份報告。

《華日》報道,被解僱的OpenAI員工之一Korbak曾是公司安全團隊成員;他表示,在針對Hugging Face入侵事件的調查中,他擔任了公司與Redwood Research及METR之間的技術聯絡人。

另外兩名被解僱的員工Wang和Balesni從事的是「對齊」工作,即確保公司模型行為符合人類意圖。

OpenAI表示,公司正致力於調查近幾個月發現的一系列智能體安全事件,並著手解決潛在安全問題。本周早些時候,OpenAI宣布因安全考慮推遲發布AI模型「GPT-6.1 Astra」。

這家ChatGPT開發商表示,公司已部署一套新的監控系統,以便更迅速發現AI代理(AI agents)的不當行為;同時,公司開始要求工程師在測試AI系統時採用更嚴格的安全防護機制,並針對模型出現不良行為的案例公開更多訊息。

當前,AI行業正面臨著嚴峻挑戰:一方面是模型能力日益強大,另一方面則是這些模型所帶來的潛在風險。

9月初,Anthropic研究員Jacob Coxon公開辭職,理由是他不願參與這場競速開發,該競賽旨在構建「能夠自我改進的AI系統」。他表示,擔心此類系統可能失控並最終毀滅人類。Anthropic對齊科學主管哈賓格(Evan Hubinger)9月8日也公開表示,他個人認為AI在未來十年內有超過10%的概率「毀滅全人類」。

Anthropic行政總裁阿莫代上月撰文說,當今尖端AI工具帶來的風險不容忽視,行業不應繼續保持這種極速發展的態勢;他呼籲放緩整個行業的發展步伐,這一觀點也得到OpenAI行政總裁奧爾特曼(Sam Altman)和馬斯克的認同。#

-------------------
局勢持續演變
與您見證世界格局重塑
-------------------

🔔下載大紀元App 接收即時新聞通知:
🍎iOS:https://bit.ly/epochhkios
🤖Android:https://bit.ly/epochhkand

📰周末版實體報銷售點👇🏻
http://epochtimeshk.org/stores