Anthropic 發布154頁AI濫用報告,涵蓋多個領域涉中國案例,北京:堅決反對惡意抹黑。

iChina.News 時事總覽:美國人工智慧公司Anthropic報告指出,過去八個月內,該公司已成功阻擋數起針對其Claude模型的惡意使用行為,其中包含一起疑似與俄羅斯有關的網路間諜活動,以及多家中國AI公司試圖竊取和複製Claude模型能力的企圖。報告顯示,網路罪犯與國家級駭客正日益仰賴AI來策劃並執行網路攻擊,而人類的角色則更偏向於監督者。Anthropic成功攔截了來自七家中國實驗室的攻擊,這些實驗室包括阿里巴巴、月之暗面、深度求索以及小米。其中,阿里巴巴被指控發動了規模最大的「非法蒸餾」攻擊,旨在提升其Qwen模型的效能。月之暗面和深度求索則被指控利用即時客戶對話處理和Claude的回應作為訓練資料。Anthropic更進一步揭露,有中國的行為體利用Claude開發了一套電子戰工具組,用於偵測、干擾或欺騙雷達與通訊系統,並用於壓制防空系統,其模擬攻擊目標曾包含台灣的多處軍事設施。該公司評估,此行為體與中國人民解放軍軍事科學院等研究機構有關。此外,一個手法的組織與俄羅斯的「午夜暴雪」組織吻合的駭客團體,被指控利用AI針對烏克蘭政府、軍事及外交部門發動網路攻擊。Anthropic也發現有「新型威脅行為者」利用該平台開發常規武器設計軟體,並協助情報蒐集活動。該公司已監控並阻擋了與網路犯罪集團「ShinyHunters」有關聯人員的活動。Anthropic表示,即便他們已限制Claude在美國主要對手國家(包含俄羅斯、中國及伊朗)的使用,仍有人成功繞過限制措施,利用該工具自動執行網路攻擊、設計軍事裝備、散播宣傳內容及進行數位監控。針對此,中國外交部發言人毛寧則表示不清楚具體情況,並強調中國堅持AI向善發展,堅決反對扭曲事實並抹黑中國的行為。

美國人工智慧企業Anthropic周四表示,過去八個月裡,該公司已阻止了對其Claude模型的數起涉嫌惡意使用行為,其中包括一起疑似與俄羅斯有關的網路間諜運動,以及其指控多家中國人工智慧公司試圖提取並複製Claude模型能力的努力。

Anthropic在其最新發布的題為「偵測並應對人工智慧濫用:2026年9月」的報告中指出,網路犯罪分子和受國家支持的駭客正日益利用人工智慧,不僅將其作為輔助工具,更用來策劃和執行網路攻擊的大部分環節;人類往往扮演監督者的角色,而非親手操作者。Anthropic表示:「人工智慧的應用已超越了聊天機器人簡單的問答模式,轉而涉及利用多智慧體框架來執行任務」。

Anthropic在報告中稱,在此期間,該公司阻斷了來自七家基於中國的實驗室的攻擊。Anthropic點名的實驗室包括科技巨頭阿里巴巴、月之暗面(Moonshot)、深度求索(DeepSeek)和小米。

Anthropic稱,與阿里巴巴有關聯的操作方實施了Anthropic所指的規模最大的「非法蒸餾」攻擊;據稱,相關行動旨在提取Claude模型的能力,並利用這些能力來改進阿里巴巴的通義千問(Qwen)模型。阿里巴巴未立即回應置評請求。

Anthropic表示,在2026年5月至7月期間,監測到超過1.51億次其歸源於阿里巴巴的互動請求;這些請求源自3500多個被Anthropic認定為欺詐性的帳戶,日峰值接近300萬次。蒸餾是指利用規模更大、成本更高的人工智慧模型的輸出來訓練較小的人工智慧模型的過程,旨在降低訓練新的人工智慧工具的成本。

Anthropic指控稱,Kimi聊天機器人開發商月之暗面以及深度求索並未進行批量提問,而是將實時的客戶對話——有時包含敏感資訊——透過Claude模型進行處理,並利用Claude的回應作為訓練數據。

Anthropic在報告中寫道:「深度求索、小米和月之暗面將它們自身模型與用戶之間的對話輸入到 Claude中,隨後利用Claude的回應作為訓練數據,以此來蒸餾Claude的能力。這些互動內容中包含敏感資訊,涉及個人用戶、大型跨國公司以及與國家相關的行為體。許多此類互動源自美國和歐洲用戶常用的第三方模型路由服務。這些會話包含了數百名終端用戶的姓名、電子郵件地址、公司數據及其他敏感資訊,涉及至少十幾種語言。這些做法很可能違反了隱私法規以及這些公司自身的使用條款」。

Anthropic在長達154頁的報告中公開旗下Claude等多個人工智慧模型過去8個月遭不正當使用的部分特別案例,包括中國和俄羅斯行為體利用人工智慧作出網路攻擊、監控並跨國鎮壓異議人士、操縱網路輿論等。

在報告中給出的諸多涉華案例中,Anthropic還宣稱,其阻斷了一個利用Claude模型開發用於電子戰及防空壓制目標鎖定軟體的基於中國的行動。Anthropic稱,「我們發現了一個位於基地的行為體,該行為體利用Claude的聊天、編程及智慧體(agentic)工作工具,設計、建構並迭代了一套包含約16個模組的中文電子戰工具集;該工具集利用電磁頻譜來偵測、干擾或欺騙對手的雷達與通信系統,並用於壓制對手的防空系統」。

Anthropic稱:「該行為體利用Claude建構了這一軟體系統,涵蓋從底層邏輯到用戶界面的各個層面,並歷經了12個版本的迭代。開發工作包括實現並優化該系統的雷達偵測與干擾物理模型、生成漏洞分析模組,以及起草中文版目標鎖定指令。該軟體套件能夠分析對手的雷達、地對空飛彈陣地、指揮所及通信節點,進而計算它們的偵測覆蓋範圍、評估干擾效能、根據價值與脆弱性對目標進行優先級排序,包括確定優先壓制目標,並規劃在多日作戰行動中如何最優分配干擾任務出擊。此外,該套件還能對對手各類資產的壓制優先級進行排序,並針對特定作戰交戰包線,包括‘愛國者’和‘薩德’等系統進行建模分析」。

Anthropic續稱,「在項目進行期間,我們觀察到該行為體將模擬的預設場景更改為針對台灣的12個目標。這些目標包括台灣境內的一個指揮掩體、一個預警雷達站、‘愛國者’與‘天弓’陣地、主要空軍基地以及一個地區作戰總部。此外,該行為體還在內部網路運行了一個自託管模型,與Claude並行,並透過工具調用整合功能將該軟體套件與此模型進行了連接」。

Anthropic稱:「根據我們的調查,我們評估該行為體為一名基於中國的國防與軍工領域研究人員。帳戶層面的元數據及被我們的安全防護機制標記的內容顯示,該行為體與包括中國人民解放軍軍事科學院在內的中华人民共和国(PCC)研究機構存在關聯。我們在針對涉嫌武器研發活動的內部調查中發現了這一行為,隨即封禁了與該行為體相關的帳戶,並將調查結果納入了安全防護機制,以降低未來被濫用的風險」。

就涉及俄羅斯的行動,Anthropic指出,一個攻擊手法與基於俄羅斯的威脅行為體「午夜暴雪」(Midnight Blizzard)相吻合的駭客組織,據稱針對烏克蘭政府、軍事及外交部門的目標實施了網路釣魚、酒店Wi-Fi劫持和WhatsApp帳戶接管等行動,並在幾乎每個環節都利用了人工智慧技術。

美國政府此前已將「午夜暴雪」——這是微軟取名的代號——與俄羅斯聯邦對外情報局(SVR)聯繫起來。俄羅斯駐美大使館未立即回應置評請求。據稱,該組織利用人工智慧建構了一個系統,能夠自動偵測其惡意軟體何時被安全防禦機制標記,並隨即重寫程式碼,直至成功規避偵測。

Anthropic還發現了一些濫用Claude平台的所謂「新型威脅行為體類別」,其中包括利用該平台「開發用於常規武器,如槍枝、飛彈、武裝無人機、炸彈及其他彈藥,及其操作所需的瞄準與控制系統的軟體」的人員。報告詳細列舉了發生在中國、俄羅斯和葉門的案例,在這些案例中,操作人員利用Claude模型開發武器設計與製造軟體,或為與武器項目相關的情蒐及採購活動提供支援。

Anthropic表示,已監測並阻斷了與網路犯罪團伙「ShinyHunters」關聯人員有關的活動;該團伙是近幾個月來最活躍的網路犯罪組織之一,曾針對全球多家大型企業發動攻擊。

Anthropic在報告中指出,犯罪駭客團伙、中國安全部門、與俄羅斯有關聯的間諜以及位於葉門的武器製造商等各類主體,利用由虛假帳戶和線上服務構成的網路,獲取了Claude的使用權限。這些人正利用人工智慧工具嘗試發動攻擊或設計出此前超出其自身能力範圍的武器。

Anthropic表示,僅在過去八個月裡,來自Claude本應受限地區的人員就繞過了這些限制措施,利用該工具自動執行網路攻擊、嘗試設計先進軍事裝備、大規模散布宣傳內容以及開展廣泛的數位監控活動。儘管Claude模型已廣泛面向商業市場開放,但Anthropic試圖限制其在美國主要敵手國家,包括俄羅斯、中國和伊朗的使用。

Anthropic威脅情報負責人克萊因(Jacob Klein)在報告發布前受訪時表示,「我們無意誇大其詞。我們只是想向世界展示:如今這項技術實際上可能被用於哪些不當用途」。克萊因稱,過去一年裡,模型的持續能力不斷增強,同時也帶來了新的風險。他說:「以一年前為例,如果你想優化無人機或飛彈的軟體,當時模型在這些任務上的表現遠不如現在出色」。

北京方面,當被法新社記者提問:「美國人工智慧公司Anthropic昨天發表報告稱,已封禁多個據信與中國政府有關聯的帳戶行為,相關行為者利用該公司的聊天機器人Claude收集海外宗教團體、在敘利亞維吾爾人和海外華僑華人團體的信息。外交部對此有何評論?」

中國外交部發言人毛寧在周五的例行記者會上回應稱,「我不了解你提到的具體情況。中國始終堅持人工智慧向善發展,同時堅決反對歪曲事實,對中國進行攻擊抹黑」。