
Anthropic公司表示,今年已多次阻止科學家利用其領先的人工智慧(AI)模型進行可能助於開發生物武器的研究企圖。
在一份描述其AI模型遭濫用的報告中,Anthropic表示無法確定這些研究是出於合法還是邪惡目的,因為有效的生物學研究——那種能帶來疫苗等突破的研究——也可能助於設計危險病原體。面對這種不確定性,Anthropic表示選擇謹慎行事,因為若漏掉惡意活動的後果可能很嚴重。
「你不會看到有人像漫畫書裡那樣說,『嘿,我想製造生物武器殺死所有人,』」Anthropic威脅情報主管雅各布·克萊因(Jacob Klein)在接受採訪時說。「情況極其微妙。」
尖端AI模型可能促進已知或全新生物病原體的開發,這是專家們對這項技術最嚴重的擔憂之一——這項技術發展如此迅速,連其領先的設計者都懷疑人類能否完全控制它。
與災難性網路攻擊或與人類意圖不符的AI智能體相比,生物濫用作為AI的生存風險較少受到關注,部分原因是過去的案例通常只出現在研究環境,而非真實世界。
戰略風險委員會(Center for Strategic and International Studies)高級研究員安德魯·韋伯(Andrew Weber)在報告發布前審閱了Anthropic的報告。他說,這些發現是「國家支持的生物武器開發者利用領先AI模型快速進展能力的案例,令人不寒而慄」。
Anthropic週四發布的長篇報告列舉了過去八個月其Claude聊天機器各模型遭濫用的一系列事例。一些例子與Anthropic和其他AI實驗室過去的披露類似,包括疑似與中國和伊朗政府有關聯的行為者針對異議人士和僑民社區進行監控。
報告還提到俄羅斯官方媒體使用Claude生成偽裝成獨立報導的線上宣傳,包括關於摩爾多瓦(Moldova)選舉的捏造內容。
Anthropic記錄了另一種它認為屬於新型的濫用:試圖利用Claude開發用於常規武器設計和開發的軟體,包括槍枝、飛彈、武裝無人機和炸彈。報告詳細描述了在中國的三起、俄羅斯的兩起和葉門(Yemen)的一起案例。
報告未點名葉門這一例涉及哪一方,但上下文清楚表明指的是伊朗支持的胡塞武裝(Houthi rebels)。恐怖網絡使用AI正日益成為美國安全官員的擔憂。
但在報告列出的所有威脅類別中,潛在的生物研究最令人擔憂。Anthropic未披露它阻止的研究人員或機構的名稱、所屬國家或所涉具體生物製劑,部分原因是其不確定這些人的目的。
儘管如此,Anthropic表示,這些科學家規避了旨在阻止被封鎖地區用戶存取其AI模型的控制措施,並設法「混淆研究目的以避開我們的安全護欄」。該公司已封禁了相關帳戶。
在五月的一個案例中,一名科學家尋求Claude協助撰寫撥款申請,以資助針對屈公熱病毒(Chikungunya virus)的研究。這是一種蚊媒疾病,可導致數月嚴重的疼痛和其他症狀。這類研究被稱為功能獲得性研究(gain-of-function research),可能合法且促成疫苗開發,但也可能製造出超級病毒。在此例中,科學家想要設計病毒突變,使其在反覆感染活體動物時更具危害性。
Anthropic表示,它認為這項研究令人擔憂,部分原因是它能夠辨別出這項工作擬在一家軍事研究機構進行。
「我們不知道的是,這項研究是否有武器化意圖,」克萊因說。「但軍事機構進行功能獲得性研究令人擔憂。」
Anthropic表示,去年對其舊模型的評估顯示,它們尚不能有效協助進行危險的生物研究。該公司稱,當前模型更有能力完成複雜科學研究,這促使其收緊了安全護欄,以限制多種兩用生物研究的提問。
微生物學家兼公共衛生專家蘇珊·莫納雷斯(Susan McCutchen)曾於奧巴馬政府負責監督國家生物安全準備工作的審查,她也在報告發布前審閱了Anthropic的報告。她說,這些發現提供了實際證據,支持了有關不良行為者正試圖秘密利用先進AI的擔憂,這些行為者試圖「提高其製造可能造成重大傷害的生物病原體的機會」。
莫納雷斯去年曾短暫擔任美國疾病管制與預防中心(CDC)主任,她說,AI有巨大前景,可開啟一個拯救和延長生命的醫學突破時代。但她補充說,使其成為可能的同樣能力也可能「讓不良行為者在光天化日之下,利用看似合法的研究製造我們可能無法預見、一旦釋放可能無法阻止的病原體」。
戰略風險委員會的韋伯也曾於奧巴馬政府擔任負責核、化學和生物防禦項目的助理國防部長。他呼籲將能夠進行這種級別生物研究的AI工具僅限於可信研究人員使用。
「俄羅斯、中國和朝鮮繼續開發被禁止的生物武器,這使我們必須阻止其研究人員使用這些極其強大的模型,」他說。