美國AI公司Anthropic的人工智能(AI)模型Claude,日前在自動化測試中向費城(Philadelphia)警方報假案,提交了一份虛假的謀殺案目擊舉報。
事件經過
據Anthropic公司周五(10月9日)在其官網發布的關於AI模型非預期行為的報告,涉事AI模型為Claude Haiku 4.5,其報假案的行為在約兩個月後才被披露。
報告透露,7月18日,AI模型Claude被要求在隨機選擇的網頁上完成互動測試任務。公司給模型的指令包括不要登錄、創建帳戶、輸入個人數據、購買或提交任何破壞性內容。測試時沒有明確禁止填寫在線表單。
結果,AI模型訪問了費城警察局專門收集未破謀殺案線索的網站PhillyUnsolvedMurders.com,並遞交了虛假的謀殺案目擊證據。
虛構目擊內容
據科技媒體TechCrunch報道,費城警察局(PPD)在分享給媒體的新聞稿中透露,該AI模型在報案的表單中寫道,自己可能掌握案件訊息,並稱曾在某條街道附近見過符合警方描述的嫌疑人。
但實際上,警方網站上並未提供嫌疑人的外貌描述,AI模型還將表格中的姓名和聯繫方式欄留空。
舉報被攔截
費城警方表示,這份舉報被系統標記為垃圾訊息,從未轉交給實時犯罪中心(Real-Time Crime Center)進行偵查審查。
警方指出,沒有證據顯示其系統遭到未經授權的訪問,或數據受到破壞。
兩月後才被發現
Anthropic承認,該公司技術人員在9月下旬才發現這一異常,並於10月7日通知了費城警方,雙方代表次日進行了會面。
警方在聲明中表示,從事件發生到通報市府延誤了兩個月,這「是無法接受的」,並要求公司加強AI相關安全防護,防止類似事件在市府不知情的情況下影響城市系統。警方強調,未破案件涉及真實的受害者和家屬。
Anthropic表示,事件發生後,測試流程已被停止。公司還收緊了AI模型在測試期間的聯網限制,修改了部份條件以避免與真實網站互動,並開發了額外的監控工具。#
-------------------
局勢持續演變
與您見證世界格局重塑
-------------------
🔔下載大紀元App 接收即時新聞通知:
🍎iOS:https://bit.ly/epochhkios
🤖Android:https://bit.ly/epochhkand
📰周末版實體報銷售點👇🏻
http://epochtimeshk.org/stores