阻斷利用 AI 的「偽裝掩護」行動
過去兩年半,我們持續報導相關案例,揭示各式各樣的手法:惡意行為者如何以不同方式嘗試利用我們的模型,進行網路攻擊、隱蔽影響力行動(IO)、詐騙,以及其他違反《使用政策》的活動。我們發布這些報告,是為了讓監管機關、業界同儕及社會大眾了解我們觀察到的威脅行為者如何試圖利用 AI,並揭示他們企圖利用的弱點。
我們近期封禁了兩場影響力行動,一場來自俄羅斯,另一場來自伊朗。它們結合我們的模型與較傳統的手法和技術,支援精心打造的「偽裝掩護」組織與身分。它們透過這些組織與身分,掩飾訊息來源,向目標受眾傳播地緣政治與衝突相關訊息。伊朗的行動經營了七個「記者」身分,用來向全球中小型網路媒體推薦長篇文章;俄羅斯的行動則似乎利用了拉丁美洲的不知情人士,在當地經營一個「智庫」。
這兩場行動都採取多管齊下的方式,嘗試運用各種策略達成目標。除了長篇文章,伊朗的行動還批次生成社群媒體留言,主題大多與美伊戰爭有關。俄羅斯的行動除了控制「智庫」,也製作假的「外洩」文件與音訊腳本;我們發現其中部分內容曾在網路上流傳。兩場行動也大量使用 AI 撰寫內部報告,這更是俄羅斯行動最主要的 AI 用途。在這兩個案例中,行為者都採用了可疑或根本具有欺騙性的方法,誇大操作者的成效。
這兩場行動最引人注目之處,在於它們與 AI 出現前的複雜影響力行動高度相似,只是運用 AI 簡化了部分工作流程。伊朗行動所經營的記者身分,與假記者「Alice(在新視窗中開啟) Donovan(在新視窗中開啟)」頗為相似。後者是俄羅斯軍事情報機關的掩護身分,其文章在 2016 至 2017 年間曾由多家西方媒體刊登。2020 年,與俄羅斯網路研究機構過往活動有關的人士,經營了一家名為「PeaceData(在新視窗中開啟)」的假「新聞」媒體,利用世界各地不知情的記者為其撰稿。
這兩場行動的潛在觸及範圍也異於尋常。依據將影響力行動從 1(最低)至 6(最高)分級的傳播突破量表(在新視窗中開啟),我們將這場源自俄羅斯的行動評為第 5 級。這是自我們開始發布報告以來,首次阻斷第 5 級行動。源自伊朗的行動則達到第 4 級。兩者都成功讓內容進入主流媒體,而非僅止於社群媒體發文;這些內容並非全由我們的模型生成。這符合我們在過去兩年半揭露的 30 場隱蔽影響力行動中觀察到的模式:試圖讓內容登上真實媒體,而非依賴假社群帳號傳播的行動,往往具有最高的潛在觸及範圍與影響力。

我們自 2024 年初以來揭露的 30 場影響力行動矩陣,依主要傳播方式(社群媒體、行動自營網站、外部刊物)及傳播突破量表評級分類。採用多種傳播方式的行動,例如經營網站並在社群媒體上推廣,則依看來最構成行動核心的方式分類。
AI 能讓這類偽裝掩護行動擴大規模、提高效率,並提升語言流暢度與編輯能力。操作者可利用這些優勢,利用毫無戒心的員工或編輯等受害者,將內容植入受眾眼前,而受眾完全不知道幕後主使者是誰,也不清楚其動機。這些行動也顯示,威脅行為者利用虛假身分與組織達成目標的手法,既複雜又精密。要讓各組織維持穩固的防禦,就必須了解威脅行為者在這些活動中利用哪些弱點,以及這些弱點如何轉化為受眾與觸及範圍。
但這類偽裝掩護行動仰賴隱蔽運作,因此負責任的揭露也特別能對其造成打擊。「Alice Donovan」與「PeaceData」都在遭到揭露後停止了活動。因此,我們報導這些偽裝掩護行動的目標,就是讓後續研究與阻斷工作更容易,也讓這些行動更難持續。
源自俄羅斯的行為者在拉丁美洲各地發動影響力行動。
我們封禁了一批源自俄羅斯的 ChatGPT 帳號。這些帳號使用 ChatGPT 執行各種任務,支援針對拉丁美洲各國的隱蔽影響力行動。其中多數活動似乎旨在損害烏克蘭在該地區的聲譽,但部分活動似乎意在左右當地政治結果,尤其是在阿根廷與玻利維亞。多數操作者以俄語輸入提示;其中一人使用西班牙語,但看來仍位於俄羅斯。我們已將此案的相關資訊分享給有關當局。
操作者主要使用 ChatGPT 執行三項任務:撰寫關於自身活動的內部報告(也包含他們能合理攬功的他人活動)、為行動製作內容,以及撰寫報告,說明拉丁美洲一個自稱「研究平台」、名為社會研究中心(SRC)的運作表現。他們似乎透過名為「Mia Clark」的虛構身分控制 SRC;我們據此將這場行動暱稱為「暗黑 Clark」。由於我們不允許從俄羅斯存取模型,他們使用 VPN 連線至我們的服務。
操作者在內部報告中聲稱,曾在拉丁美洲各地散布假報導,以打擊烏克蘭或當地領導人。公開來源(在新視窗中開啟)研究人員(在新視窗中開啟)已將其中部分造假內容歸因於一個名為「Politology」或「La Compania」的俄羅斯組織。據報,該組織承接了瓦格納集團及俄羅斯寡頭 Yevgeniy Prigozhin 創辦的其他組織。操作者也要求我們的模型翻譯或解釋關於 Politology 和瓦格納的公開報導,次數遠多於詢問其他源自俄羅斯的網絡。
這場行動有兩點不同尋常。首先,它似乎成功利用了拉丁美洲的當地人士為 SRC 工作。俄羅斯操作者關於 SRC 的報告提到薪資級距、聘僱與解僱等決策,顯示他們是在控制該組織,而非與其合作。現有證據顯示,SRC 在拉丁美洲的員工並不知道自己是在為一個俄羅斯團體工作。與我們近期揭露的另一個與俄羅斯有關的「智庫」不同,SRC 似乎透過這些被利用的員工,產出了以原創為主的內容。這是我們過去兩年半阻斷的案例中,經營掩護身分最複雜的一次嘗試。
其次,部分公開來源證據顯示,「暗黑 Clark」的造假內容傳播甚廣,足以引發事實查核(在新視窗中開啟)與官方否認(在新視窗中開啟),顯示其滲透程度超過我們過去兩年阻斷的任何影響力行動。該行動聲稱曾在秘魯植入一項造假內容,甚至加劇了烏克蘭與波蘭之間公開的緊張關係。
操作者使用 ChatGPT 的主要方式,是草擬與更新呈交給一名身分不明上級的內部報告。這些定期報告描述了在拉丁美洲各地執行隱蔽影響力行動的情況。報告涵蓋三項主要工作:貶損烏克蘭並破壞烏克蘭武裝部隊的招募;干預特定國家的國內政治,尤其是玻利維亞與阿根廷;以及管理 SRC。在多數情況下,我們並未觀察到威脅行為者使用模型為行動製作內容,而只是用來撰寫相關報告(少數例外詳見下文)。
這些報告包含豐富的戰術細節,揭示了該行動如何企圖打擊烏克蘭及部分國家領導人,尤其是阿根廷、玻利維亞與厄瓜多的總統。部分報告描述了如何誘騙當地人從事可供操作者利用的活動;另一些則描述了操作者聲稱散布的假「外洩」資料。
有兩個案例的證據,將操作者與有關「Politology」的公開報導連結起來。操作者回報,他們在 2024 年發動了兩場針對阿根廷總統 Javier Milei 的行動。第一,他們表示曾散布假報導,聲稱 Milei 為自己的狗購買了卡地亞珠寶項圈。第二,他們聲稱曾付錢給當地人士,在布宜諾斯艾利斯塗寫反對 Milei 的塗鴉。根據外洩文件,這兩項活動都已被公開(在新視窗中開啟)歸因於(在新視窗中開啟)「Politology」與「La Compania」。
還有更多造假內容先前未曾被認為與俄羅斯的影響力行動有關。例如,操作者聲稱,他們在 2026 年 5 月建立了一個假冒秘魯利馬地區教育局的電子郵件地址。他們利用這個信箱,指示轄區內的學校在全國文化與語言多樣性日(5 月 21 日)舉辦烏克蘭主題活動。這些電子郵件明確指示活動須提及若干人物,包括備受爭議的二十世紀烏克蘭民族主義者 Stepan Bandera。部分烏克蘭人將他視為獨立運動人物,但在俄羅斯與波蘭,他則與法西斯主義、戰時通敵及暴行聯繫在一起。據操作者所述,部分學校回覆了這個假信箱,確認已舉辦相關活動,甚至還提供了照片。
操作者隨後聲稱,他們已將這些活動的報導植入秘魯與波蘭的媒體,並附帶指控烏克蘭正在「輸出」極端民族主義意識形態,引發了憤怒。透過公開來源搜尋,我們在秘魯(在新視窗中開啟)以及(在新視窗中開啟)波蘭(在新視窗中開啟)的媒體(在新視窗中開啟),以及匈牙利(在新視窗中開啟)一家英語刊物中,找到了與這項說法相符的報導(其中部分文章後來已遭刪除)。部分(在新視窗中開啟)文章(在新視窗中開啟)引述了一名波蘭籍歐洲議會議員的回應,提議將表現出「反波蘭態度」的人列為波蘭的不受歡迎人物。這項俄羅斯造假內容既利用了烏克蘭人與波蘭人之間的歷史矛盾,也進一步加劇了雙方的緊張關係。
同樣地,操作者在 6 月聲稱,他們利用另一個假電子郵件地址,誘騙厄瓜多的學校舉辦儀式,宣誓效忠總統 Daniel Noboa 及私人軍事承包商黑水公司的前負責人 Erik Prince。操作者聲稱,這起事件在厄瓜多引發憤怒,迫使政府出面駁斥造假內容,反而讓它傳播至全國。公開來源研究再次在厄瓜多(在新視窗中開啟)的新聞界(在新視窗中開啟)找到與這項說法高度吻合的媒體(在新視窗中開啟)報導(在新視窗中開啟),甚至還有厄瓜多教育部長的詳細駁斥(在新視窗中開啟)。
操作者運用各種手法,為他們的虛假報導營造可信度。根據他們的內部報告,他們在 3 月散布了兩項針對厄瓜多的不同造假內容。其中一項使用假音訊,冒稱是烏克蘭駐厄瓜多領事貶低厄瓜多人的言論。我們的公開來源調查發現一則 TikTok 貼文,與這項說法完全吻合;該貼文似乎只獲得了有限的互動。另一項則描述了一段在 X 和 TikTok 上散布的假影片,冒用真實新聞頻道的標誌,聲稱 Noboa 政府正在招募年輕男性赴烏克蘭作戰。厄瓜多的事實查核人員(在新視窗中開啟)在 4 月初描述了一場與此相符的行動。

2026 年 4 月 8 日發布的 TikTok 影片,包含該行動聲稱製作、冒充烏克蘭領事發言的假音訊。
另一份內部報告描述了他們在 5 月底玻利維亞反政府抗議最激烈時散布的一項造假內容。操作者明確表示,這場行動的目標是加劇抗議所引發的危機。這場行動使用一段冒充國營自來水公司 EPSAS 員工的假錄音,聲稱政府將切斷行政首都拉巴斯的供水,並宣布進入緊急狀態。我們的公開來源研究找到針對同一說法的闢謠文章(在新視窗中開啟),以及 EPSAS 的官方否認聲明(在新視窗中開啟)。
其他內部報告中也包含一些我們無法透過公開來源佐證的造假內容,可能是因為它們已遭下架,或未能傳播開來。例如,操作者聲稱在 1 月散布了一則報導,指稱一名巴西網紅兼模特兒遭烏克蘭大使館代表販運至烏克蘭,並在基輔遇害。6 月,他們聲稱在玻利維亞散布了另一段假音訊,這次冒稱是玻利維亞中央銀行員工發出的警告,指央行即將限制現金提款。他們也聲稱散布了一封冒充該國油氣主管機關的偽造信函,警告將限制對私家車的燃料銷售。
在其他報告中,操作者要求我們的模型協助找出目標國家內可供他們攬功的事件,即使他們並未參與。例如,在阿根廷,操作者聲稱,阿根廷外交部長在聯合國一場關於福克蘭群島/馬爾維納斯群島的委員會會議上,引用了他們行動中的論述。操作者自稱是他們率先散布了「自決原則不適用於該群島」及「英國在當地維持不成比例的軍事部署」這兩項論點。事實上,這兩項論點早已是阿根廷的官方立場,持續了相當(在新視窗中開啟)多年(在新視窗中開啟)。同樣地,巴西媒體在 6 月報導(在新視窗中開啟)了一名巴西公民的遭遇:他前往烏克蘭參軍,遭俄軍俘虜,之後在電視聲明中聲稱自己是受騙才投入戰鬥。使用 ChatGPT 的操作者試圖聲稱,這篇報導重現了他們行動所傳播的訊息;事實上,報導引用的是俘虜本人的影片(在新視窗中開啟)。這顯示操作者可能是在試圖對自己的雇主,而非任何外部受眾,發動影響力行動。
操作者的部分報告提到一個自稱為「研究平台」的社會研究中心(俄文名稱意為社會學研究中心)。根據社會研究中心(SRC)的網站,其研究重點為拉丁美洲的印度僑民,以及印度與該地區各國的關係。
內部報告顯示,操作者似乎掌控了這個智庫,而不只是與其合作。例如,報告提及聘僱與解僱決策、薪資級距、人力配置計畫,以及正在進行的研究專案。更關鍵的是,報告還指出,操作者創造了一個名為「Mia Clark」的虛構身分,用來經營該行動的社群媒體活動,並與拉丁美洲當地員工聯繫。現有證據顯示,這些當地員工並不知道自己在替俄羅斯的行動工作,而是真誠地執行研究任務。這種利用不知情中間人的做法,與俄羅斯先前同樣涉及 Prigozhin 勢力的「PeaceData」行動極為相似;Meta 於 2020 年揭露(在新視窗中開啟)了該行動。
從俄羅斯操作者的報告判斷,他們在拉丁美洲的當地員工訪談了該地區各地的專家與評論人士,再根據訪談結果撰寫研究報告。研究主題廣泛,從對金磚國家集團的民意綜合分析,到詳細比較 Jair Bolsonaro 與 Luiz Inácio Lula da Silva 兩位總統任內的巴西經濟。有時,俄羅斯操作者在研究成果尚未發表前,就已撰寫專案進度報告,顯示他們深入參與了製作過程。我們在 SRC 網站上找到遠超過 60 篇文章,其中絕大多數似乎是原創作品。這使「暗黑 Clark」有別於我們近期揭露的另一場源自俄羅斯的行動;後者也以智庫為掩護,但大部分內容都是抄襲的。這顯示「暗黑 Clark」可能有意建立一個更持久、在拉丁美洲各地擁有人脈的掩護組織。
為了推廣 SRC 的成果,俄羅斯操作者聲稱曾嘗試建立一個社群媒體帳號網絡。根據他們的報告,這些社群媒體活動遇到了問題:世界各地的操作者嘗試存取相同帳號,導致帳號受到限制。公開資料中可見相關痕跡:例如,SRC 在 X 上主要帳號的透明度資訊顯示所在地為德國(可能是使用 VPN 所致),卻透過俄羅斯聯邦 App Store 連線;其一個 Instagram 帳號的透明度資訊則顯示,管理員位於委內瑞拉。我們找到的三個以 SRC 為名的 Facebook 帳號,追蹤人數都未達顯示管理員所在地的門檻。

左:與社會研究中心有關的 X 帳號。請注意,透明度資訊顯示該帳號透過俄羅斯聯邦 App Store 連線。右:SRC 的 Instagram 帳號;請注意所在地為委內瑞拉。
操作者回報,在 LinkedIn 上遇到的問題尤其明顯。他們表示,建立了一個明知是假的帳號來代表 SRC,卻難以為它拓展人脈網絡。根據他們的報告,解決方式是建立更多假帳號來追蹤第一個帳號,讓它看起來更可信。截至 8 月 17 日,一個使用相同社會研究中心品牌識別的 LinkedIn 帳號有 961 名追蹤者,聲稱擁有 200 至 500 名員工,卻只列出兩名員工。
除了使用 AI 更新報告,操作者偶爾也會要求我們的模型協助構思並撰寫可用於行動的文字,例如協助確保造假內容採用符合各國的口音、用語及機構文書風格。這在整體工作中所占比例相對較小,可能是因為該行動似乎至少有一名來自拉丁美洲、以西班牙語為母語的成員,因此對 AI 語言支援的需求較低。
例如,有一次,一名使用俄語的操作者要求模型協助以俄語草擬一封信,意圖將烏克蘭駐巴拿馬名譽領事牽涉進貪腐事件。接著,使用西班牙語的操作者要求模型將信函翻譯成西班牙語,並生成搭配使用的音訊腳本。一個自稱新聞媒體、卻使用巴拿馬 TVN Noticias(在新視窗中開啟) 標誌的 TikTok 帳號,發布了一張與該信函文字相符的照片,並配上與操作者腳本相符的旁白。這個 TikTok 頻道只有一名追蹤者,植入這項造假內容後就停止發文。

TikTok 貼文展示了一封文字由該行動生成的信函,搭配的旁白腳本同樣由該行動生成。
另一次,位於俄羅斯、使用西班牙語的操作者向模型提供一份俄語腳本,聲稱 Noboa 侮辱了厄瓜多的窮人,並要求模型將其翻譯成厄瓜多西班牙語。第三次發生在 3 月,同一名使用者要求模型校對一份西班牙語合約草稿。合約雙方是一家名為「International Security Solutions FZE」的公司與一名厄瓜多人士,聲稱要在烏克蘭提供基礎設施服務。使用者的問題聚焦於如何改善用語與版面,包括詢問哪些字詞應加粗。
合約用語定稿後,使用者便不再提出相關提示。然而,公開來源研究顯示,這份「合約」的圖片後來曾在社群媒體上流傳(在新視窗中開啟)。它被用來佐證一項說法:Noboa 政府與一家掩護公司合作,誘騙厄瓜多人加入烏克蘭軍隊。這項造假內容傳播甚廣,促使查核人員在 4 月初進行事實查核(在新視窗中開啟)。查核結論指出,該公司「未出現在厄瓜多公司、證券與保險監理局的登記資料中」。
這場行動的影響需要格外謹慎地評估。如上所述,操作者的主要手法之一,就是將與自身行動毫無關係的活動據為己功。因此,不能照單全收他們在內部報告中對自身影響力的說法。同樣地,他們聲稱植入的部分假報導,並未出現在公開來源研究中,可能是透過非公開管道散布、已遭下架,或根本未曾發布。
不過,公開來源證據讓我們得以佐證他們的部分說法。該行動聲稱散布的部分造假內容,後來確實被事實查核人員報導,並遭政府駁斥,顯示其傳播範圍已廣到值得回應。在其他案例中,我們也能在網路上找到與該行動生成內容高度吻合的資料。最值得注意的是,該行動聲稱誘騙一所秘魯學校舉辦了呈現 Bandera 形象的活動。這件事後來獲得拉丁美洲與歐洲媒體報導,似乎還引發至少一名波蘭籍歐洲議會議員發表評論。
依據將影響力行動從 1(最低)至 6(最高)分級的傳播突破量表(在新視窗中開啟),我們將這場行動評為第 5 級,因為有證據顯示,它促使多國政治人物公開發表評論。這是自我們開始發布報告以來,首次阻斷第 5 級行動。
源自伊朗的行動,以虛假署名將長篇文章植入網路新聞媒體。
我們封禁了一批源自伊朗的 ChatGPT 帳號。這些帳號以波斯語輸入提示,並生成波斯語與英語內容。行為者透過 VPN 存取 ChatGPT,以隱藏所在地。
這場行動使用我們的模型潤飾長篇文章與投稿提案、生成社群媒體留言,以及潤飾內部報告。操作者使用七個不同署名投稿,因此我們將這場行動命名為「假署名」。這些長篇文章聚焦於美伊衝突。多數留言同樣圍繞這場衝突;少數涉及美國政治,通常也置於衝突的更廣泛脈絡中。
他們各項主要工作的表面影響力有顯著差異。我們在全球約十多家網路媒體中,找到近 100 篇以該行動所用署名發表或轉載的文章。這些都是中小型媒體,主要關注國際事務、地緣政治及中東事件。相較之下,這些社群媒體留言似乎都未能獲得大量按讚、分享或後續回覆。事實上,操作者的內部報告使用了具有誤導性的計算方式來衡量社群媒體影響力,可能是為了讓操作者看起來更有成效。
整體活動看來符合商業行為者受僱執行影響力行動的模式,但我們無法確認具體涉事者。我們已將此案的相關資訊分享給有關當局。
這場行動觸及範圍最廣的活動,是要求 ChatGPT 審閱並潤飾探討美伊衝突地緣政治的英語長篇文章。典型的提示會要求模型依據特定網路媒體的投稿標準,評估英語草稿,並提出修改建議以確保符合要求。操作者核准修改後,便要求模型生成一封電子郵件,讓他們向該網路媒體的編輯推薦文章。
這些投稿信使用了七個不同的虛假署名:Ervin B. Hoskins、Noah Lamington、Sophia Gonzalez、Michael Harrison、Ericka Feusier、Jenny Williams 及 Alice Johnson。根據部分文章隨附的網路個人簡介,每個虛構身分都自稱是西方記者,通常是美國人,但 Noah Lamington 的簡介則聲稱人在紐西蘭。這些身分往往以國際政治、中東、人權或衝突為專業領域。其中一個虛構身分「Michael Harrison」的個人簡介,也是操作者要求模型撰寫的。(值得注意的是,Meta 在 3 月阻斷(在新視窗中開啟)了一場伊朗影響力行動,其中也使用了名為「Michael Harrison」的記者身分。)
部分虛構身分還在多個社群媒體平台設有帳號,以增加可信度。例如,Michael Harrison 這個身分在 Medium、X 及 Facebook 上都有帳號作為掩護。Ervin B. Hoskins 這個身分則在 X、Facebook、Instagram 及 Threads 上設有帳號。其簡介自稱是「美國自由撰稿人」,但社群媒體透明度資訊顯示,這些帳號位於伊朗。

上:Ervin Hoskins 虛構身分的 Instagram 個人簡介。左下:X 帳號透明度資訊,顯示使用西亞 Android 應用程式。右下:Instagram 帳號透明度資訊,顯示所在地為伊朗。Meta 已於 8 月停權該 Instagram 帳號。
運用公開來源調查技術,我們在十多家不同刊物中,找到近 100 篇以操作者所用署名之一發表的文章。這些刊物主要關注國際事務、地緣政治及中東事件,有時採取反戰或進步派觀點。我們找到的最早文章發表於 2025 年 7 月,最新文章則發表於 2026 年 10 月。美伊衝突爆發後,文章發表頻率大幅增加。

2025 年 7 月至 2026 年 9 月的文章時間軸,依作者與主題分類。請注意,自 2026 年 3 月起,美伊關係相關文章密集出現。

2026 年 2 月至 7 月間,各網路媒體以與本行動有關的署名所發表的文章標題範例。
至少有部分文章隨後獲得相關媒體的社群帳號推廣,使伊朗操作者有機會接觸原本無法觸及的受眾。
除了文章外,威脅行為者也要求 ChatGPT 以英語或波斯語,批次生成地緣政治或政治主題的留言。他們的典型做法是輸入社群媒體貼文的文字或截圖,要求模型生成一組符合其整體方向的回覆。這些回覆隨後被發布到網路上,彼此往往只相隔幾分鐘。操作者的內部報告提到人工與自動化發文兩種方式;我們沒有證據顯示,這些自動化作業是藉助我們的模型進行的。

本行動生成並於 7 月發布的英語推文(左)與波斯語推文(右)。英語留言回覆的是一則警告美國正準備對伊朗發動「大規模攻擊」的英語推文;圖中所有英語留言都在 10 分鐘內發布。波斯語留言則回覆一則關於美國打擊伊朗的波斯語推文,並在 13 分鐘內發布。
這些批次留言活動中,有一部分是為介紹該行動自產新聞文章的社群媒體貼文生成回覆。操作者輸入推廣其文章的貼文截圖,再生成讚揚或支持文章的留言,可能是為了讓文章看起來更受歡迎。

一個美國地方新聞 Facebook 專頁分享了該行動生成的文章,下方留言也由該行動生成。
多數批次留言則更廣泛地聚焦於伊朗、美國與以色列之間的衝突。使用者要求生成飛彈攻擊、停火及外交角力等主題的留言,並指定將美國描繪為侵略者、以色列描繪為美國不可靠的盟友,伊朗則是頑強不屈、堅韌的受害者。操作者針對設於英國、批評伊朗政權的衛星電視網「伊朗國際」貼文,生成了格外大量的回覆,其中帶有敵意的波斯語回覆超過 24 批。少數批次則針對美國政治議題的社群媒體貼文生成回覆,通常也置於衝突的更廣泛脈絡中。

本行動生成的 Instagram 留言,用來回覆美國政治相關貼文。
我們發現少量回覆確實被發布到網路上;更多回覆未出現在公開來源搜尋結果中,可能是因為未曾發布,或發布這些回覆的帳號已遭移除。(例如,Ericka Feusier、Alice Johnson 與 Jenny Williams 這三個記者身分,在公開簡介中列出了 X 帳號名稱;截至 2026 年 8 月,這些帳號都已遭停權。)部分確實在網路上留言的帳號,名稱看似來自西方,但帳號所在地顯示為伊朗。

發布上圖留言的 Instagram 帳號透明度資訊,顯示帳號位於伊朗。
在我們找到這些回覆的貼文中,它們通常只占留言總數的少數,顯示操作者的聲量並未壓過真實使用者的回應。這些回覆似乎也未吸引大量互動;事實上,該行動回覆中的許多按讚,來自同樣與該行動有關的帳號。我們已將此案的相關資訊分享給業界合作夥伴,他們最有能力全面評估互動情況。
讓自身活動看起來更受歡迎的企圖,並不僅限於對外發布的貼文。除了生成內容,操作者偶爾也要求 ChatGPT 潤飾一些看來是關於其社群媒體行動的內部報告。典型做法是提供模型一系列統計數據,再要求它整理成精美的簡報。
在我們阻斷的行動中,這不是第一個利用 AI 撰寫自身(在新視窗中開啟)績效評估(在新視窗中開啟)的案例。伊朗操作者這種自評成績的做法,最引人注目的是其採用的評估方法。他們使用的主要「影響力」指標,是所回覆原貼文的瀏覽次數(而非回覆本身的瀏覽次數),分別在發布回覆前,以及發布後一段未指明的時間進行統計。這種計算未排除其他因素帶來的瀏覽次數,例如原貼文本身的人氣或其他留言。因此,這種方式大幅誇大了行動的影響力數字,顯示操作者可能不知道更有效的計算方法,或選擇不採用。
事實上,從公開來源觀察所得的證據來看,這場行動的兩項主要工作,可能產生的影響程度似乎差異甚大。
我們能找到的社群媒體回覆,按讚、瀏覽及留言數通常偏低,僅有個位數或兩位數。如上所述,這些回覆通常只占相關貼文留言總數的少數。依據將影響力行動從 1(最低)至 6(最高)分級的傳播突破量表(在新視窗中開啟),我們將這部分行動評為第 2 級:留言出現在多個平台,但幾乎沒有突破原有傳播範圍或主導回覆區的跡象。
相較之下,這些記者身分成功讓文章登上多家媒體,其中部分擁有大量追蹤者。例如,截至 2026 年 8 月,一家刊登該行動文章的網路媒體,在 Facebook 上有近 200 萬名追蹤者、X 上近 35.5 萬名,Instagram 上則超過 54.4 萬名。由於這部分行動持續突破原有傳播範圍、進入多家媒體,我們將其評為第 4 級。


