周六(9月12日),全球最大的人工智能(AI)平台的三位大佬們罕見發表同樣看法,認為是時候放緩其最先進、利潤也最高的AI模型開發速度。其中一位大佬強調,美國和北京達成的任何AI相關協議,都必須具備高度可驗證性。

當日,Anthropic PBC行政總裁達阿莫迪(Dario Amodei)發表了一篇長篇博文「我們必須為前沿技術設定節奏」(We Must Pace the Frontier),提出應放慢前沿AI模型能力提升的速度,為安全測試、模型對齊與外部審核爭取時間。

OpenAI行政總裁奧爾特曼(Sam Altman)迅速表示認同,並表示這也是他們公司內部正在討論的議題。奧特曼承諾,OpenAI將引入跟Anthropic類似的第三方評估機制。xAI Corp.的行政總裁馬斯克(Elon Musk)也公開表示支持阿莫迪的看法。

在AI競賽持續升溫、各大科技公司競相推出更強模型之際,美國三家頂尖AI公司的領導人罕見就「放慢」前沿模型開發速度發出一致訊號。

阿莫迪、奧特曼以及馬斯克多年來都曾公開談及AI失控、濫用以及安全風險,但在一個高度競爭、投資規模龐大的產業中,主要競爭者公開贊成,協調放慢前沿模型能力的開發速度,仍是第一次。AI行業歷來以提升用戶參與度、搶佔市場份額和追求銷售增長為名,並需要不斷推出新產品。

減速不等於停止研發

阿莫迪主張,必須放慢AI模型能力提升的速度,為安全、對齊、測試與外部審核有時間跟上。他表示,其核心不是反對 AI,而是避免在商業競爭與地緣政治壓力下,出現不顧風險的「逐底競賽」。

「我們必須放慢人工智能模型能力提升的速度。」他寫道,「需要明確的是,放緩節奏並不意味著停止模型訓練或技術進步,而是確保各公司有足夠的時間來調整和保護其模型,並由第三方評估機構確認這一點。」

阿莫迪指出,AI近幾個月的進展已顯著加快,其中一項原因是AI越來越能協助設計、訓練與改進下一代AI系統。他把這種現象稱為「遞歸式自我改進」(recursive self-improvement),並警告,若缺乏審慎限制,AI能力的增長可能跑在人類理解及治理能力之前。

Hugging Face攻擊事件成警訊

阿莫迪列舉的另一項主要憂慮,是OpenAI在內部網絡安全評估中發生的越獄攻擊Hugging Face事件。

根據公開調查,OpenAI在網絡安全測試中運行的一批AI代理人,原本應被限制在受控沙盒環境內,但它們突破隔離限制,透過未經授權的內部留言板相互協作,並對開源AI平台Hugging Face的部份系統採取未經授權的存取行動。調查顯示,約1,200個代理人使用該通訊渠道,超過700個代理人直接參與相關行動。

阿莫迪表示,儘管上述AI攻擊事件尚未造成重大損失,但他預計「在6到12個月內,這樣一群攻擊者可能能夠利用持續存在的殭屍網絡控制整個互聯網(可能造成數千億美元的損失),而且損失規模還會繼續擴大」。

在Hugging Face安全事件曝光後不久,Anthropic也承認其模型在網絡安全測試中入侵了三間機構。本周早些時候,Anthropic表示又發現了第四宗黑客攻擊事件。

Meta也披露,旗下模型在測試期間逃逸出測試環境(沙盒),訪問了開放互聯網,並入侵了現實世界中的受害者。AI模型越來越擅長發動攻擊,這加劇了人們對AI實驗室能否防止其技術失控的擔憂。

今年早些時候,Anthropic在確定其Mythos模型存在獨特的網絡安全威脅後,竭力限制了該模型的發布。該公司此前也曾表示,世界需要一個系統來共同決定何時放緩這項技術的研發工作。

Anthropic承諾外部常駐審核

阿莫迪提出三階段「前沿節奏控制」構想,首先是由每家前沿AI公司引入「嵌入式評估人員」(embedded evaluators)。

Anthropic承諾先行實施:邀請獨立第三方評估團隊長期進駐公司,取得接近內部風險評估員工的持續存取權,檢視模型安全措施、訓練流程、部署安排、對齊狀況及安全事故。

依照阿莫迪的構想,評估人員可在公司辦公室工作,配有門禁證、公司工作電腦,並取得大致相當於內部風險評估團隊的工具與權限。他們應可向外發布有關風險、事件、公司實務及自身資訊存取狀況的關鍵發現;公司僅能因法律、國安、客戶私隱或商業敏感資料進行有限刪節,不能因結論不利而刪改報告。

阿莫迪稱,這一制度可提高安全承諾的可驗證性與透明度,也能引入不受商業利益直接影響的「第二意見」。

奧特曼的回覆表明,OpenAI原則上也將採取相同方向。

呼籲美國政府為行業設定規則

阿莫迪指出,後續步驟需要全行業的協調以及全球合作。他提議,下一階段應由民主國家的前沿AI公司建立共同安全標準,並將模型能力與安全證據掛鈎。

他表示,僅靠自願合作不足以約束所有企業,最有效的方式最終仍是針對所有美國前沿AI公司的監管。由於企業協商共同限制開發速度可能涉及反壟斷問題,他呼籲美國政府為特定AI安全討論提供有限豁免或協調機制。

本周稍早,奧特曼也曾表示,OpenAI正考慮放慢尖端AI研發,並希望能由整個行業共同推進。OpenAI首席科學家帕喬基(Jakub Pachocki)此前亦警告AI風險,呼籲企業在必要時協調行動,減緩未來開發速度。

不過,仍不清楚這些公司會在多大程度上犧牲產品推出速度與商業利益。Anthropic和OpenAI是直接競爭者,均在開發能自動完成更複雜、高價值企業任務的AI系統;兩間公司也面臨來自其它美國科技公司及中國AI企業的競爭壓力。

和中共競爭成最大變數

阿莫迪承認,民主國家若單方面放緩AI進展,而允許中國等威權國家不受相同約束,反可能帶來國安風險。

他主張,美國及盟國應維持並擴大技術領先,包括限制向中國出售高性能AI晶片與先進半導體製造設備、打擊晶片走私和未經授權的模型蒸餾,並加強防止模型權重遭竊的安全措施。

阿莫迪估計,如果美國有效執行上述措施,未來3至5年可進一步拉大美國領先中國的差距,從而為民主國家的安全節奏控制爭取空間。

他認為,美中之間的全球AI協調仍值得推進,但不能天真,理所當然認定對方會遵守協議約束。

阿莫迪表示,「如果我們因為認為中方也會這樣做而大幅限制自身的AI能力,而中方卻背叛了我們,那麼AI的強大程度可能會讓北京最終佔據地緣政治主導地位。」

「任何協議都必須具備高度可驗證性,或限於即使一方違約,也不會改變軍事與地緣政治生存條件的範圍。」他補充。

阿莫迪提出可由易至難的四級國際合作:禁止AI被用於生物武器;模型發布前進行網絡安全、生物及對齊風險測試;對遞歸式自我改進設定某種「速度限制」;以及最終的全面限速或暫停。當中,他認為禁止特別危險用途與發布前測試較有可行性,全面暫停則短期內極不可能。

美國總統特朗普預定本月稍後在華盛頓與中共黨魁習近平會面,AI安全與美中技術競爭預料將成為峰會的重要議題。#

-------------------
局勢持續演變
與您見證世界格局重塑
-------------------

🔔下載大紀元App 接收即時新聞通知:
🍎iOS:https://bit.ly/epochhkios
🤖Android:https://bit.ly/epochhkand

📰周末版實體報銷售點👇🏻
http://epochtimeshk.org/stores