
Anthropic是一家美國人工智慧(AI)公司,成立於2021年。該公司開發了Claude,這是一個大型語言模型系列,並以其在人工智慧安全(尤其是可解釋性)方面的研究而聞名。(RICCARDO MILANI/Hans Lucas/AFP via Getty Images)
【看中國2026年9月11日訊】(看中國記者金言綜合報導)9月10日,美國人工智慧公司Anthropic發布長達140餘頁的威脅情報報告《檢測與反制人工智慧濫用》,披露其搗毀了一項針對天主教、藏傳佛教、臺灣基督教群體以及法輪功的宗教事務情報行動。在報告涉及的多個監控案例中,法輪功是被系統性、持續性追蹤的核心目標之一。
Anthropic在報告中說,公司封禁了一組賬戶,這些賬戶被認為與中共政府支持、位於中國境內的情報行動有關。行動者要求Claude充當其分析團隊的一員,用中文構建針對亞洲各地宗教領袖和華人社群的檔案,行動目標精準契合中共宗教事務統戰機構的優先事項。行動者身處中國大陸,其中一名用戶在對話中透露自己是中共政府的信息安全官員。
報告披露,這些行動者指示Claude生成官方內部安全部門使用的分析文件類型,包括"人物調研底稿"、調查"線索報",以及每日"態勢感知"摘要,每份記錄都要求詳細列出目標人物的涉華活動、負面信息,以及統戰部門術語中所謂可資利用的"工作抓手"。
在報告披露的五條工作流程中,專門針對法輪功的一條名列其中:行動者持續追蹤法輪功學員及相關媒體人員,包括神韻藝術團和新唐人電視臺的工作人員,產出每日監測摘要。報告還公開了一張截圖,顯示行動者收集了一名海外法輪功學員的領英(LinkedIn)頁面資料,此人是飛天大學中城分校的教師。Anthropic說,行動者收集海外法輪功群體相關教育工作者和修煉者的資料,是其針對海外華人社群行動的組成部分之一,研究對象既包括資深宗教領袖,也包括普通公民。
值得注意的是,行動者在給Claude的操作指令中,明確要求模型採用"中共立場",除了將西藏流亡政府定性為"非法分裂政權"外,還特別指示對法輪功套用官方定性中的"邪教"用語。這種要求模型剔除中立表述、直接採納官方敘事的做法,貫穿了整個行動的操作細節。而中共對法輪功的抹黑與迫害,據公開資料顯示已持續27年。
從行動手法看,這一情報活動呈現出高度組織化的特徵。Anthropic分析認為,該行動者很可能專職負責宗教事務情報收集工作,因為其指示Claude同時運行四條工作流程,以多種語言接收原始素材,並依據內部模板生成結構化的中文檔案。每個模板都要求概述目標人物與中國相關的活動、可能構成醜聞的負面信息,以及可利用的"抓手"。收集的具體信息類型十分詳盡,包括目標人物的出生日期、出生地、移民記錄、社交媒體賬號,行動者還對宗教活動場所進行偵察,繪製平面圖、外觀圖和結構圖。
在信息來源渠道上,行動覆蓋了中國境內外的多個社交平臺,包括微信、小紅書、抖音、微博,以及領英、Instagram、Threads、X和Facebook,部分目標要求每日更新生成報告,顯示出行動的常態化、持續化特徵。
除法輪功外,報告列出的其他四條工作流程分別針對:亞洲各地的天主教資深樞機主教,產出按主題分類的目標檔案;臺灣長老教會的領導階層,產出多份目標檔案及場地偵察資料,節奏為事件驅動;藏傳佛教流亡政府與維權團體及在中國註冊的相關社團,產出情境摘要和組織資料集,按日和批量輸出;以及與新加坡、香港和中國大陸相關的基督教傳教士網路,產出國家安全風格的"線索報告",視特別指定情況而定。
Anthropic在報告開篇說明,公司之所以公開這些案例,是出於對濫用行為進行披露的責任感,並提醒隨著模型能力不斷增強,除非AI開發者和社會防禦力量共同採取行動,否則相關風險將進一步上升。在監測到上述惡意行為後,公司已封禁負責此次活動的賬戶集群,並基於案例強化了檢測系統,以識別和阻斷未來可能出現的類似濫用行為。
這一發現也與報告其他部分披露的監控類案例相互印證。據公開報導對該報告的轉述,Anthropic在報告中還提到,中國的一個宗教事務情報收集單位過去曾配備多個分析師團隊,如今已縮減為一個單一辦公室,轉而藉助AI助手每月產出數千份調查。這一表述從側面說明,法輪功等海外宗教群體所面臨的監控壓力,並未因人力資源縮減而減弱,反而藉助AI工具實現了監控效率的提升。
報告全文可在Anthropic官網下載,其中除本文提及的宗教事務監控案例外,還詳述了針對俄羅斯國家背景網路間諜行動、伊朗官方宣傳機構"認知戰"項目等多起案例。