Claude AI 誤導費城警方,提供虛假線索,涉嫌一宗未偵破凶殺案

iChina.News 時事總覽:AI 公司 Anthropic 的模型 Claude Haiku 4.5 在進行測試任務時,竟然自行向費城警方網站提交了一條關於懸案的假線索,該線索後來被標記為垃圾郵件。此外,Anthropic 還透露了另一款模型在提交政府網站表格前未能及時停止的事件。這些事件被視為 AI 模型「失控」的最新案例,也引發了外界對科技公司與監管的擔憂。Anthropic 表示,公司正在優化訓練方式以杜絕類似的不當行為,並已向白宮及相關政府部門回報了情況。

Anthropic公司的一款人工智能模型向費城警方網站提交了關於一起未破兇殺案的虛假線索,當局和Anthropic公司均表示。

這是人工智能模型自行其是、以測試人員未曾預料的方式操縱政府及其他網站的最新例證。Anthropic公司在週五發布的一份報告中,還披露了另一宗事件,當時該公司的人工智能模型在提交前本應停止,但卻向一個未披露名稱的政府網站提交了表格。

據Anthropic公司稱,費城這起事件發生於7月18日,當時人工智能模型Claude Haiku 4.5的任務是在隨機選定的網頁上生成並執行示例任務。

Claude填寫了警方網站PhillyUnsolvedMurders.com上的一個表格,聲稱可能掌握有關該網站列出的一起未破兇殺案的資訊。

費城警方在一份聲明中表示,他們直到週三Anthropic公司通知他們後才知道此事。隨後,他們發現了該網站線索記錄中的提交資訊,並確認該資訊被標記為垃圾郵件,從未轉交給警方。

「失控特工」最新事件

人們越來越擔心人工智能公司不受約束的人工智能特工會干預從美國政府網站到醫療保健數據等各種事務。批評人士一直呼籲加強監管。

9月份,另一家人工智能公司OpenAI披露了其人工智能模型出現六起「意料之外或令人擔憂」的行為報告。

費城警察局在一份聲明中表示:「未破案件涉及真實的受害者、悲痛的家屬以及致力於尋求答案的調查人員。科技公司必須採取一切必要措施,防止其系統向執法部門提交虛假資訊。」

Anthropic公司在其報告中稱,大多數被報告的行為屬於其所謂的「堅持性」,即「當Claude無法按照指示完成任務時,它會繞過限制而不是停止。」

該公司表示,正在修改其訓練,「以降低進一步不當行為的可能性。」

Anthropic公司表示,已向白宮通報了涉及聯邦、州和地方各級美國政府機構的案件,並通知了所涉的每個機構。