跳至主要內容
OpenAI

2025年6月1日

安全

「嘲評」行動:源自中國的影響力活動

OpenAI 封禁了利用 AI 生成貼文、批評一名台灣社群媒體網紅及美國相關議題的帳號。

載入中…

本案例研究最初刊載於 OpenAI 的2025 年 6 月⁠(在新視窗中開啟)報告。

行動者

我們發現有些 ChatGPT 帳號使用我們的模型大量生成社群媒體貼文,其行為模式與隱蔽影響力行動相符,因此封禁了這些帳號。調查期間,我們也觀察到這些帳號起草內部績效考核文件。

這些帳號主要以中文輸入提示詞,內容聚焦於和中國相關的政治及地緣政治議題。一名使用者在提示詞中自稱任職於中國宣傳部門;然而,我們沒有獨立證據可核實此說法。

行為

我們封禁的帳號主要從事兩類工作。其中產出最多的一類,是以英文和中文生成簡短的社群媒體留言,另有少量烏爾都文留言。我們發現許多這類留言被發布於 TikTok 和 X,另有部分內容出現在 Reddit、Facebook 及各類網站。

典型模式是先由一個「主要」帳號發布首則留言;該帳號往往看似專為這則貼文而建立,之後再由其他帳號陸續回覆。這種行為似乎旨在營造自然互動的假象。

與「嘲評」行動相關的 TikTok 貼文。

與此活動相關、標題為「關閉 #USAID 只是個 #開始!」的 TikTok 貼文。頻道名稱、影片字幕文字及這張螢幕截圖中可見的所有留言,均由此網路利用 ChatGPT 生成。

在 TikTok 上,留言帳號使用各種語言和文字系統的顯示名稱,而且往往與其發布內容的語言無關。例如,一個使用韓文名稱的帳號以烏爾都文留言;另有使用泰文和希伯來文名稱的帳號,發布由此網路生成的英文留言。在 X 上,留言帳號通常使用卡通個人資料圖片,部分帳號的名稱則與加密貨幣有關。

與「嘲評」行動相關的推文及回覆。

推文及其回覆留言,全部由此網路利用 ChatGPT 生成。

此網路在 Facebook 上較不活躍。其活動主要是為兩個假冒新聞媒體的粉絲專頁生成名稱和個人資料圖片。兩個粉絲專頁都沒有任何追蹤者或按讚,而且各自僅發布了少量貼文。

與「嘲評」行動相關的 Facebook 貼文。

分享影片的 Facebook 貼文;我們判斷該影片可能與此行動有關。

此網路偶爾也會生成篇幅較長的中文或英文貼文。我們在 Reddit 發現一篇這類貼文,另有兩篇出現在不同的網路論壇。第二類工作是利用 ChatGPT 生成疑似內部政策或績效考核文件。

產出內容

此威脅行動者生成的社群媒體內容涵蓋多種議題,且全都與中國的地緣戰略利益密切一致。

部分內容聚焦台灣,尤其針對《逆統戰》⁠(在新視窗中開啟)(英文名「Reversed Front」)。這是一款以台灣為主題,想像反抗中國共產黨情境的電玩與桌遊。此網路生成了數十則批評該遊戲的中文留言,隨後又發表一篇長文,聲稱該遊戲遭到廣泛抨擊。這是該行動最具辨識度的活動,因此我們將其命名為「嘲評」行動。

其他英文和烏爾都文內容則針對巴基斯坦倡議人士 Mahrang Baloch;她曾公開批評中國在俾路支省的投資⁠(在新視窗中開啟)。與此網路有關的一個 TikTok 帳號和一個 Facebook 粉絲專頁發布影片,誣指 Baloch 曾出演色情片。該行動隨後以這兩種語言生成數百則簡短留言,營造廣泛互動的假象。

Mahrang Baloch TikTok 影片下的留言。

Mahrang Baloch TikTok 影片下表示震驚的留言。

最後一組內容聚焦於美國國際開發署(USAID)的關閉,並生成簡短留言,對此舉表示讚揚或批評。這些留言發布於 TikTok 和 X。

「嘲評」行動生成、將援助與關稅掛鉤的推文。

此網路利用 ChatGPT 生成的推文,將援助問題與關稅問題相互掛鉤。

最後,這些威脅行動者利用我們的模型生成疑似內部文件,包括一篇模仿官方公安文件文風撰寫的詳細文章,以及一份說明建立和運作此行動各項步驟的績效考核文件。

影響

我們中斷此行動使用我們模型時,它似乎仍處於起步階段。兩個 Facebook 粉絲專頁都沒有任何追蹤者。在 Reddit 上,一篇貼文獲得 44 個頂票,另外兩篇則遭其發布所在的子版封鎖或移除。

與「嘲評」行動相關、已遭移除的 Reddit 貼文。

我們認定屬於此網路的 Reddit 帳號貼文螢幕截圖,顯示該貼文已遭平台的過濾機制移除。

X 和 TikTok 上的互動情況較為不一:兩支 TikTok 影片合計獲得 25,000 個讚,而此行動主要帳號的推文通常每篇約有 10,000 次瀏覽。然而,這些貼文下的許多留言都是此網路利用 ChatGPT 生成,顯示至少有部分互動並非真實。因此,所有互動數據都應審慎看待。

若 X 和 TikTok 的互動數據屬實,依據衡量影響力行動成效的突破量表⁠(在新視窗中開啟),我們會將此行動評為第 3 類別的低端。如果出現更多證據支持大多數按讚和瀏覽次數如同大多數留言一樣並非真實,我們會下調此評級。