跳到主要內容
OpenAI

2026年10月8日

安全

瓦解借助 AI 的「虛假掩護」行動

正在載入...

過去兩年半,我們持續報告威脅行為者如何嘗試利用我們的模型,以各種方式進行網絡攻擊、秘密影響力行動(IO)、詐騙及其他違反我們《使用政策》的活動。我們發表這些報告,旨在讓監管機構、業界同儕及社會大眾了解我們觀察到的威脅行為者如何試圖利用 AI,並揭示他們企圖利用的弱點。

我們最近封禁了兩項影響力行動,一項源自俄羅斯,另一項源自伊朗。兩者均結合我們的模型與較傳統的手法及技術,支援精心構建的「虛假掩護」實體。他們透過這些實體掩飾訊息來源,將地緣政治及衝突相關的宣傳訊息傳遞給目標受眾。伊朗行動使用了七個「記者」身份,向世界各地的中小型網上媒體推介長篇文章;俄羅斯行動則似乎利用了拉丁美洲的不知情人士,在當地營運一個「智庫」。

兩項行動均多線並進,嘗試以多種策略達成目標。除了長篇文章,伊朗行動亦批量生成社交媒體留言,主題大多與美伊戰爭有關。俄羅斯行動除了控制「智庫」,亦製作了偽造的「外洩」文件及錄音稿,我們發現其中部分內容曾在網上流傳。兩項行動亦大量使用 AI 撰寫內部報告,俄羅斯行動在這方面的使用更超過任何其他用途。兩者均以存疑、甚至公然欺騙的方法,誇大操作人員的成效。

這些行動最引人注目之處,在於它們與 AI 出現之前的複雜影響力行動十分相似,只是利用 AI 簡化了部分工作流程。伊朗行動操控的記者身份,與假記者「Alice⁠(在新視窗中開啟) Donovan⁠(在新視窗中開啟)」有相似之處。這個身份是俄羅斯軍事情報機構的掩護,其文章曾於 2016 至 2017 年在多家西方媒體刊登。2020 年,與俄羅斯互聯網研究局過往活動有關的人士營運了一家名為「PeaceData⁠(在新視窗中開啟)」的假「新聞」媒體,利用世界各地不知情的記者為它撰稿。

這些行動的潛在傳播範圍亦異乎尋常。按影響力行動的突破量表⁠(在新視窗中開啟)評估,我們會將源自俄羅斯的行動列為第 5 級。該量表將影響力行動分為第 1 級(最低)至第 6 級(最高)。這是自我們開始發表報告以來,首次瓦解第 5 級行動。源自伊朗的行動則達到第 4 級。兩項行動都成功令內容進入主流媒體,而不只是發佈於社交媒體;這些內容並非全部由我們的模型生成。這與我們在過去兩年半揭露的 30 項秘密影響力行動中觀察到的模式一致:試圖讓內容進入真實媒體,而非依賴虛假社交媒體帳戶傳播的行動,往往具有最大的潛在傳播範圍及影響力。

30 項影響力行動的矩陣,按主要傳播方式及突破量表評級分類。利用外部刊物的行動達到第 4 及第 5 級;以社交媒體為主的行動則達到第 1 至第 3 級。

我們自 2024 年初以來揭露的 30 項影響力行動矩陣,按主要傳播方式(社交媒體、行動自營網站、外部刊物)及突破量表評級分類。採用多種傳播方式的行動,例如營運網站並在社交媒體推廣,則按看來構成行動核心的方式分類。

AI 可以擴大這類虛假掩護行動的規模、提高效率,並提升語言流暢度及編輯能力。操作人員可以利用這些優勢,操縱毫無戒心的受害者,例如員工或編輯,將內容推送給完全不知道幕後主使者及其動機的受眾。這些行動亦顯示,威脅行為者利用虛構身份及實體達成目標的手法既複雜又精密。要讓各機構維持穩健的防禦,必須了解威脅行為者在這些行動中利用哪些弱點,以及這些弱點如何讓他們接觸受眾、擴大傳播範圍。

然而,這些虛假掩護行動仰賴隱蔽性,也因此特別容易受到負責任披露的打擊。「Alice Donovan」及「PeaceData」在被揭露後,均停止了活動。因此,我們報告這些虛假掩護行動,目的是促進後續研究及阻截工作,同時讓這些行動更難繼續。

俄羅斯:「暗黑 Clark」行動

源自俄羅斯的行為者在拉丁美洲各地開展影響力活動。

行為者

我們封禁了一組源自俄羅斯的 ChatGPT 帳戶。他們使用 ChatGPT 執行一系列與秘密影響力行動有關的任務,目標是拉丁美洲各國。這些活動大多似乎旨在損害烏克蘭在區內的聲譽,但部分似乎意在影響當地政治結果,尤其是阿根廷及玻利維亞。大部分操作人員以俄語輸入提示;其中一人使用西班牙語,但看來仍位於俄羅斯。我們已與相關當局分享此案的資料。

操作人員主要使用 ChatGPT 執行三類任務:撰寫有關自身活動的內部報告(以及他們可合理地據為己功的他人活動)、為行動製作內容,以及撰寫有關拉丁美洲一個自稱「研究平台」的社會研究中心(SRC)之工作表現報告。他們似乎透過名為「Mia Clark」的虛構身份控制 SRC;我們因而將這項行動命名為「暗黑 Clark」。由於我們不允許從俄羅斯存取模型,他們使用 VPN 連接我們的服務。

操作人員在內部報告中聲稱,曾在拉丁美洲各地散播虛假報道,以抹黑烏克蘭或當地領袖。公開資料⁠(在新視窗中開啟)研究人員⁠(在新視窗中開啟)已將其中部分虛假內容歸因於一個名為「Politology」或「La Compania」的俄羅斯組織。據報,該組織承接了俄羅斯寡頭 Yevgeniy Prigozhin 創立的瓦格納集團及其他組織的活動。操作人員亦要求我們的模型翻譯或解釋有關 Politology 及瓦格納的公開報道,次數遠超他們就其他源自俄羅斯的網絡所提出的問題。

這項行動有兩個不尋常之處。第一,它似乎成功招攬了拉丁美洲人士為 SRC 工作。俄羅斯操作人員有關 SRC 的報告,提及薪級、聘用及解僱等決定,顯示他們控制着該組織,而非僅與它合作。現有證據顯示,SRC 在拉丁美洲的員工並不知道自己正為一個俄羅斯組織工作。與我們最近揭露的另一個與俄羅斯有關的「智庫」不同,SRC 似乎透過這些被利用的員工,製作了以原創為主的內容。在過去兩年半我們瓦解的行動中,這是最複雜的掩護身份營運嘗試。

第二,部分公開證據顯示,「暗黑 Clark」的虛假內容傳播廣泛,足以引發事實查核⁠(在新視窗中開啟)及官方闢謠⁠(在新視窗中開啟)。這反映其滲透程度超過了我們過去兩年瓦解的任何影響力行動。該行動聲稱在秘魯植入的一則假消息,甚至加劇了烏克蘭與波蘭之間的民間緊張關係。

內部報告

操作人員使用 ChatGPT 的主要方式,是撰寫及更新向一名身份不明的上級提交的內部報告。這些定期報告描述了他們在拉丁美洲各地開展秘密影響力活動的工作。報告涵蓋三項主要工作:貶低烏克蘭並破壞烏克蘭武裝部隊的招募工作;干預某些國家的內政,尤其是玻利維亞及阿根廷;以及管理 SRC。在大多數情況下,我們沒有觀察到威脅行為者使用我們的模型為宣傳活動製作內容,只看到他們用模型撰寫活動報告(少數例外會在下文⁠說明)。

這些報告包含豐富的策略細節,揭示該行動如何試圖打擊烏克蘭及部分國家領袖,尤其是阿根廷、玻利維亞及厄瓜多爾的總統。部分報告描述如何誘騙當地人進行某些活動,讓操作人員可將之用作攻擊素材;其他報告則描述了操作人員聲稱散播的虛假「洩密」內容。

在兩個個案中,證據將操作人員與有關「Politology」的公開報道聯繫起來。操作人員報告稱,他們於 2024 年開展了兩場針對阿根廷總統 Javier Milei 的宣傳活動。首先,他們表示曾散播一則虛假報道,聲稱 Milei 為自己的狗購買了 Cartier 珠寶頸圈。其次,他們聲稱曾付錢給當地人士,在布宜諾斯艾利斯塗上反 Milei 塗鴉。根據外洩文件,這兩項活動均已被公開⁠(在新視窗中開啟)歸因於⁠(在新視窗中開啟)「Politology」及「La Compania」。

還有更多虛假內容,此前未曾被發現與俄羅斯的影響力行動有關。例如,操作人員聲稱,他們在 2026 年 5 月建立了一個假冒秘魯利馬地區教育局的電郵地址。他們利用這個地址,指示區內學校在全國文化及語言多樣性日(5 月 21 日)舉辦以烏克蘭為主題的活動。電郵明確指示學校提及多名人物,包括具爭議的二十世紀烏克蘭民族主義者 Stepan Bandera。部分烏克蘭人視他為爭取獨立的人物,但在俄羅斯及波蘭,人們則將他與法西斯主義、戰時通敵及暴行聯繫起來。據操作人員所述,部分學校回覆了這個假電郵地址,確認已舉辦相關活動,甚至提供了照片。

操作人員隨後聲稱,他們在秘魯及波蘭媒體植入了有關活動的報道,並指控烏克蘭正在「輸出」極端民族主義意識形態,引發公憤。公開資料搜尋在秘魯媒體⁠(在新視窗中開啟)及⁠(在新視窗中開啟)波蘭⁠(在新視窗中開啟)報刊⁠(在新視窗中開啟),以及匈牙利⁠(在新視窗中開啟)一家英語刊物中,找到與這項聲稱相符的報道(部分文章其後已被刪除)。部分⁠(在新視窗中開啟)文章⁠(在新視窗中開啟)引述了一名波蘭籍歐洲議會議員的回應,建議波蘭將表現出「反波蘭立場」的人列為不受歡迎人物。這宗俄羅斯造假事件既利用了烏克蘭人與波蘭人之間由歷史積怨造成的緊張關係,也進一步加劇了這種關係。

同樣,操作人員聲稱,他們在 6 月利用另一個假電郵地址,誘騙厄瓜多爾學校舉行儀式,向總統 Daniel Noboa 及私人軍事承包商黑水公司前主管 Erik Prince 宣誓效忠。操作人員聲稱,事件在厄瓜多爾引發公憤,令政府承受壓力而出面闢謠,反而使這則假消息傳遍全國。公開資料研究再次在厄瓜多爾⁠(在新視窗中開啟)報刊⁠(在新視窗中開啟)找到與這項聲稱高度相符的媒體⁠(在新視窗中開啟)報道⁠(在新視窗中開啟),甚至找到厄瓜多爾教育部長的詳細反駁⁠(在新視窗中開啟)。

操作人員運用多種手法,為虛假報道製造佐證。根據他們的內部報告,他們在 3 月散播了兩則針對厄瓜多爾的不同虛假內容。其中一則使用冒充烏克蘭駐厄瓜多爾領事的偽造錄音,聲稱他發表了貶低厄瓜多爾人的言論。我們的公開資料調查發現一則 TikTok 帖文,與這項聲稱完全吻合;該帖文似乎只獲得有限互動。另一則則涉及一段在 X 及 TikTok 流傳的假影片,冒用真實新聞頻道的標誌,指控 Noboa 政府招募年輕男子到烏克蘭作戰。厄瓜多爾的事實查核人員⁠(在新視窗中開啟)在 4 月初記錄了一場與這項描述相符的宣傳活動。

經遮蔽部分資料的 TikTok 截圖:2026 年 4 月 8 日的一則帖文,散播冒充烏克蘭駐厄瓜多爾領事的偽造錄音。

2026 年 4 月 8 日發佈的 TikTok 影片,包含該行動聲稱製作、冒充烏克蘭領事的偽造錄音。

另一份內部報告描述了他們在 5 月底、反政府示威最激烈期間,於玻利維亞散播的一則假消息。操作人員明確表示,這場宣傳活動的目的是加劇示威引發的危機。活動使用了一段冒充國營供水公司 EPSAS 員工的偽造錄音,聲稱政府將切斷行政首都拉巴斯的供水,並宣佈進入緊急狀態。我們透過公開資料研究,找到針對同一說法的闢謠文章⁠(在新視窗中開啟),以及 EPSAS 的官方否認聲明⁠(在新視窗中開啟)。

其他內部報告還提及一些我們無法從公開資料核實的虛假內容,可能是因為它們已被移除,或未能傳播開去。例如,操作人員聲稱曾在 1 月散播一則報道,指一名巴西網紅兼模特兒被烏克蘭大使館代表販運到烏克蘭,並在基輔被殺。他們聲稱在 6 月於玻利維亞散播了另一段偽造錄音,這次冒充玻利維亞中央銀行員工,警告央行即將限制現金提款。他們亦聲稱散播了一封冒充該國油氣管理機構的偽造信件,警告將限制向私家車銷售燃料。

在其他報告中,操作人員要求我們的模型協助找出目標國家發生的事件,即使他們未曾參與,也能據為己功。例如,在阿根廷,操作人員聲稱阿根廷外長曾在聯合國一個有關福克蘭/馬爾維納斯群島的委員會會議上,引用其行動散播的內容。操作人員聲稱,民族自決原則不適用於該群島,以及英國在當地維持不合比例軍事部署這兩項論點,都是由他們散播開來的。事實上,這兩項論點多年來⁠(在新視窗中開啟)一直⁠(在新視窗中開啟)是阿根廷官方立場的一部分。同樣,巴西媒體在 6 月報道⁠(在新視窗中開啟)了一名巴西公民的個案:他前往烏克蘭參軍,被俄軍俘虜後,在電視播出的聲明中聲稱自己是受騙參戰的。使用 ChatGPT 的操作人員試圖聲稱,這篇報道轉述了其行動的宣傳訊息;事實上,報道引用的是該名俘虜本人的影片⁠(在新視窗中開啟)。這顯示操作人員試圖開展的影響力行動,針對的其實是自己的僱主,而非任何外部受眾。

「研究平台」

操作人員的部分報告提到一個自稱「研究平台」的組織,名為社會研究中心(俄語為 Центр социологических исследований)。根據社會研究中心(SRC)的網站,該中心專注研究拉丁美洲的印度僑民,以及印度與區內各國的關係。

內部報告顯示,操作人員控制着這個智庫,而非僅與它合作。例如,報告提及聘用及解僱決定、薪級、員工配置計劃,以及進行中的研究項目。更關鍵的是,報告亦指出,操作人員創建了一個名為「Mia Clark」的虛構身份,用來管理該行動的社交媒體活動,並與拉丁美洲的當地員工聯絡。現有證據顯示,這些當地員工並不知道自己正為一項俄羅斯行動工作,而是真誠地執行研究任務。這種利用不知情人士充當中間人的做法,與較早前同樣與 Prigozhin 勢力圈有關的俄羅斯行動「PeaceData」十分相似;Meta 於 2020 年揭露⁠(在新視窗中開啟)了該行動。

從俄羅斯操作人員的報告來看,他們在拉丁美洲的當地員工訪問了區內各地的專家及評論員,再根據訪問結果撰寫研究報告。研究主題涵蓋廣泛,從對金磚國家民意的宏觀分析,到詳細比較 Jair Bolsonaro 與 Luiz Inácio Lula da Silva 兩位總統任內的巴西經濟。有時,俄羅斯操作人員會在研究成果發表前,撰寫相關項目的進度報告,顯示他們深入參與了製作過程。我們在 SRC 網站上找到遠超 60 篇文章,當中絕大多數似乎都是原創。這使「暗黑 Clark」有別於我們最近揭露的另一項源自俄羅斯的行動:後者同樣以智庫作掩護,但大部分內容都是抄襲的。這顯示「暗黑 Clark」有意建立一個更持久、聯繫遍及拉丁美洲的掩護組織。

俄羅斯操作人員聲稱,為推廣 SRC 的工作,他們曾嘗試建立社交媒體帳戶網絡。根據他們的報告,這些社交媒體活動遇到了問題:分處世界各地的操作人員嘗試登入同一批帳戶,導致帳戶受到限制。公開資料中亦可見相關痕跡:例如,SRC 的主要 X 帳戶在透明度設定中顯示所在地為德國(可能因為使用了 VPN),卻透過俄羅斯聯邦 App Store 連線;而其一個 Instagram 帳戶的透明度設定則顯示管理員位於委內瑞拉。我們找到的三個使用 SRC 品牌的 Facebook 帳戶,追蹤人數均未達到觸發顯示管理員所在地設定的門檻。

社會研究中心的帳戶透明度資料截圖:其 X 帳戶透過俄羅斯聯邦 App Store 連線,Instagram 帳戶則列出所在地為委內瑞拉。

左:與社會研究中心有關的 X 帳戶。請留意透明度設定,顯示該帳戶透過俄羅斯聯邦應用程式商店連線。右:SRC 的 Instagram 帳戶,所在地顯示為委內瑞拉。

操作人員報告稱,在 LinkedIn 遇到的問題尤其明顯。他們表示,曾建立一個明確屬於虛構、用來代表 SRC 的帳戶,但之後難以為它建立聯繫網絡。根據他們的報告,解決方法是建立更多假帳戶,追蹤最初的帳戶,令它看起來更可信。截至 8 月 17 日,一個使用相同社會研究中心品牌的 LinkedIn 帳戶有 961 名追蹤者,聲稱擁有 200 至 500 名員工,但只列出兩名員工。

製作虛假內容

操作人員除了利用 AI 更新報告,偶爾亦要求我們的模型協助構思及撰寫可用於行動的文本,例如協助確保虛假內容所用的口音、詞彙及機構行文風格,符合不同國家的習慣。這只佔整體工作的一小部分,可能是因為該行動似乎至少有一名來自拉丁美洲、以西班牙語為母語的成員,因此較少需要 AI 提供語言支援。

例如,有一次,一名使用俄語的操作人員要求模型協助以俄語起草一封信,內容旨在指稱烏克蘭駐巴拿馬名譽領事涉及貪腐。隨後,使用西班牙語的操作人員要求模型將信件翻譯成西班牙語,並生成配套錄音稿。一個自稱新聞媒體的 TikTok 帳戶,發佈了一張與信件文字吻合的照片,配上與操作人員稿件一致的旁白,但使用的卻是巴拿馬TVN Noticias⁠(在新視窗中開啟)的標誌。該 TikTok 頻道只有一名追蹤者,植入這則虛假內容後便停止發帖。

經遮蔽部分資料的 TikTok 截圖,展示一封有關烏克蘭與巴拿馬金融界接觸的偽造信件,配有該行動生成的旁白。

TikTok 帖文展示一封信,信件文字及所配旁白稿均由該行動生成。

另一次,這名身處俄羅斯、使用西班牙語的操作人員,向模型提供了一份俄語稿件,聲稱 Noboa 曾侮辱厄瓜多爾的貧困人士,並要求模型將之譯為厄瓜多爾西班牙語。第三次是在 3 月,同一使用者要求模型校對一份西班牙語合約草稿。合約訂立雙方是一家名為「International Security Solutions FZE」的公司及一名厄瓜多爾人士,聲稱要在烏克蘭提供基建服務。使用者的問題集中於如何改善語言及版面,包括詢問哪些字詞應以粗體顯示。

合約措辭定稿後,使用者便不再就合約輸入提示。然而,公開資料研究顯示,這份「合約」的圖片其後曾在社交媒體流傳⁠(在新視窗中開啟)。這張圖片被用來支持一項指控,聲稱 Noboa 政府與一家掩護公司合作,誘騙厄瓜多爾人加入烏克蘭軍隊。這則虛假內容傳播廣泛,足以在 4 月初引發事實查核⁠(在新視窗中開啟)。查核人員結論指出,該公司「並未列於厄瓜多爾公司、證券及保險監管局的登記冊中」。

影響

評估這項行動的影響,必須格外審慎。如上所述,操作人員的主要手法之一,是將與自身行動無關的活動據為己功。因此,不能照單全收他們在內部報告中自述的影響力。同樣,他們聲稱植入的部分虛假報道,並未在公開資料研究中出現。這可能是因為內容透過非公開渠道傳播、已被移除,或根本未曾發佈。

不過,公開證據讓我們得以核實他們的部分聲稱。該行動聲稱散播的部分虛假內容,其後獲事實查核人員報道,亦遭政府闢謠,顯示其傳播範圍已廣泛到值得回應。在其他個案中,我們能在網上找到與該行動生成內容高度吻合的材料。最值得注意的是,該行動聲稱曾誘騙一所秘魯學校舉辦展示 Bandera 形象的活動。事件其後獲拉丁美洲及歐洲媒體報道,並似乎促使至少一名波蘭籍歐洲議會議員作出評論。

按影響力行動的突破量表⁠(在新視窗中開啟)評估,我們會將這項行動列為第 5 級。該量表由第 1 級(最低)至第 6 級(最高);現有證據顯示,這項行動促使多國政治人物公開評論。這是自我們開始發表報告以來,首次瓦解第 5 級行動。

伊朗:「虛假署名」行動

源自伊朗的行動,以欺騙性署名向網上新聞媒體植入長篇文章。

行為者

我們封禁了一組源自伊朗的 ChatGPT 帳戶。他們以波斯語輸入提示,並生成波斯語及英語內容。這些行為者透過 VPN 存取 ChatGPT,以隱藏所在地。

該行動使用我們的模型潤飾長篇文章及投稿提案、生成社交媒體留言,以及改進內部報告。操作人員使用七個不同署名推介文章,因此我們將這場宣傳活動稱為「虛假署名」。長篇文章的焦點是美伊衝突。大部分留言同樣圍繞這場衝突;少部分涉及美國政治,通常亦置於衝突的更廣泛背景之中。

他們幾項主要工作所呈現的影響,差異甚大。我們找到近 100 篇以該行动所用署名發表或轉載的文章,分佈於世界各地約十多家網上媒體。這些都是中小型媒體,通常聚焦國際事務、地緣政治及中東事件。相比之下,社交媒體留言似乎都沒有帶來大量讚好、分享或進一步回覆。事實上,操作人員在內部報告中採用了具欺騙性的計算方式衡量社交媒體影響力,可能是為了誇大自身的工作成效。

整體活動模式與商業機構受僱開展影響力行動的做法相符,但我們未能確定涉事的具體組織。我們已與相關當局分享此案的資料。

植入文章

這項行動中傳播最廣的活動,是要求 ChatGPT 審閱及潤飾探討美伊衝突地緣政治的英語長篇文章。典型的提示會要求模型按某家網上媒體的投稿準則評估英語草稿,並提出修改建議,確保稿件符合要求。操作人員確認修改後,便要求模型生成一封電郵,用來向該網上媒體的編輯推介文章。

這些投稿電郵使用了七個不同的虛假署名:Ervin B. Hoskins、Noah Lamington、Sophia Gonzalez、Michael Harrison、Ericka Feusier、Jenny Williams 及 Alice Johnson。根據部分文章附載於網上的作者簡介,每個虛構身份都自稱是西方記者,通常是美國人,惟 Noah Lamington 的簡介聲稱身在新西蘭。他們往往自稱專注報道國際政治、中東、人權或衝突。其中一個虛構身份「Michael Harrison」的個人簡介,更是由操作人員要求模型撰寫的。(值得注意的是,Meta 在 3 月瓦解⁠(在新視窗中開啟)了一項伊朗影響力行動,當中亦有一個名為「Michael Harrison」的記者身份。)

部分虛構身份在多個社交媒體平台設有帳戶,以增加可信度。例如,Michael Harrison 這個身份在 Medium、X 及 Facebook 均有帳戶作支撐。Ervin B. Hoskins 這個身份則在 X、Facebook、Instagram 及 Threads 設有帳戶。這個身份的簡介自稱是「美國自由撰稿人」,但社交媒體透明度設定顯示帳戶位於伊朗。

Ervin Hoskins 虛構身份的 Instagram 個人簡介及帳戶透明度面板。X 顯示使用西亞 Android 應用程式,Instagram 則顯示帳戶所在地為伊朗。

上:Ervin Hoskins 虛構身份的 Instagram 個人簡介。左下:X 帳戶透明度資料,顯示使用西亞 Android 應用程式。右下:Instagram 帳戶透明度資料,顯示所在地為伊朗。Meta 於 8 月封禁了該 Instagram 帳戶。

我們運用公開資料調查方法,找到近 100 篇使用操作人員其中一個署名發表的文章,分佈於十多家不同刊物。這些刊物通常聚焦國際事務、地緣政治及中東事件,有時採取反戰或進步派視角。我們找到的文章中,最早一篇發表於 2025 年 7 月,最新一篇則於 2026 年 10 月發表。美伊衝突爆發後,文章發表頻率大幅增加。

以「虛假署名」行動七個虛構身份發表文章的時間線,按主題及作者分類。美伊相關報道佔比最大,並從 2026 年 3 月起密集出現。

2025 年 7 月至 2026 年 9 月的文章時間線,按作者及主題分類。請留意,從 2026 年 3 月起,有關美伊關係的文章密集出現。

以與該行動有關的虛構身份發表的五篇文章標題,署名分別為 Alice Johnson、Noah Lamington、Michael Harrison、Sophia Gonzalez 及 Ervin Hoskins。

2026 年 2 月至 7 月期間,以與該行動有關的署名在多家網上媒體發表的文章標題示例。

至少有部分文章其後獲相關媒體的社交媒體帳戶推廣,讓伊朗操作人員有機會接觸原本無法觸及的受眾。

大量發佈留言

除了文章,威脅行為者亦要求 ChatGPT 批量生成有關地緣政治或政治議題的英語或波斯語留言。他們的典型做法是輸入社交媒體帖文的文字或截圖,要求模型生成一組符合其整體宣傳方向的回覆。這些回覆隨後會發佈到網上,彼此往往只相隔數分鐘。操作人員的內部報告提及人手及自動發佈兩種方式;我們沒有證據顯示這些自動化操作借助了我們的模型。

並排展示的英語及波斯語回覆截圖,內容由該行動生成並於 7 月發佈,帳戶身份已遮蔽。

該行動生成並於 7 月發佈的英語(左)及波斯語(右)推文。英語留言回覆的是一則警告美國正準備對伊朗發動「大規模攻擊」的英語推文。圖中所有英語留言均在 10 分鐘內發佈。波斯語留言回覆的是一則有關美國襲擊伊朗的波斯語推文,均在 13 分鐘內發佈。

部分批量留言活動,是為介紹該行動自身新聞文章的社交媒體帖文生成回覆。操作人員會輸入推廣其文章的帖文截圖,再生成讚揚或支持文章的留言,很可能是為了讓文章看起來更受歡迎。

經遮蔽部分資料的 Facebook 截圖:一個本地新聞專頁分享了由該行動生成、署名 Sophia Gonzalez 的文章,下方有四則同由該行動生成的留言。

美國一個本地新聞 Facebook 專頁分享了該行動生成的文章;帖文下方的留言亦由該行動生成。

大多數批量留言較廣泛地圍繞伊朗、美國及以色列之間的衝突。使用者要求生成有關導彈襲擊、停火及外交角力等議題的留言,並指定內容須將美國描繪成侵略者、以色列描繪成美國不可靠的盟友,以及將伊朗描繪成不屈而堅韌的受害者。操作人員尤其大量生成回覆,針對設於英國、批評伊朗政權的衛星電視網絡 Iran International 所發佈的帖文,共生成了超過 24 批帶有敵意的波斯語回覆。少部分批次則為美國政治議題的社交媒體帖文生成回覆,通常亦置於衝突的更廣泛背景之中。

兩則經遮蔽部分資料的 Instagram 留言,由該行動生成,用來回覆有關美國政治的帖文。

該行動生成的 Instagram 留言,用來回覆有關美國政治的帖文。

我們找到少量已發佈到網上的回覆;更多回覆未能在公開資料搜尋中找到,可能是因為它們未曾發佈,或發佈它們的帳戶已被移除。(例如,Ericka Feusier、Alice Johnson 及 Jenny Williams 這三個記者身份,在公開簡介中列出了 X 帳戶名稱;截至 2026 年 8 月,這些帳戶均已被停用。)部分確實在網上留言的帳戶,名稱看似來自西方,但帳戶所在地卻顯示為伊朗。

經遮蔽部分資料的 Instagram 帳戶透明度面板,顯示發佈上述留言的兩個帳戶均位於伊朗。

發佈上圖留言的 Instagram 帳戶之透明度設定,顯示它們位於伊朗。

在我們找到已發佈回覆的帖文中,這些回覆通常只佔留言總數的一小部分,顯示操作人員的聲音並未在真實回應中佔據主導地位。這些回覆似乎亦未吸引大量互動;事實上,該行動回覆所獲的許多讚好,都來自本身與該行動有關的帳戶。我們已與業界夥伴分享此案資料;他們最有條件全面評估互動情況。

內部報告

他們試圖製造活動廣受歡迎的假象,並不只限於面向公眾的帖文。除了生成內容,操作人員偶爾亦要求 ChatGPT 潤飾一些看來是有關其社交媒體宣傳活動的內部報告。典型做法是向模型提供一系列統計數據,再要求模型將之整理成精美簡報。

這並非我們首次瓦解利用 AI 撰寫自身⁠(在新視窗中開啟)績效評估⁠(在新視窗中開啟)的行動。伊朗操作人員自行評核工作成效,最引人注目的是他們採用的方法。他們使用的主要「影響力」指標,是所回覆帖文的瀏覽次數(而非回覆本身的瀏覽次數),分別在回覆發佈前,以及發佈後某個未有說明的時間點計算。這種計算方式沒有扣除可能由其他因素帶來的瀏覽量,例如原帖文的人氣或其他留言。因此,這大幅誇大了該行動的影響力數據,顯示操作人員不是不知道更有效的計算方法,就是選擇不採用。

影響

事實上,根據公開資料觀察所得的證據,該行動兩項主要工作的實際影響程度似乎相差甚遠。

我們能找到的社交媒體回覆,其讚好、瀏覽及留言數通常偏低,只有個位數或雙位數。如上所述,這些回覆通常只佔相關帖文留言總數的一小部分。按影響力行動的突破量表⁠(在新視窗中開啟)評估,我們會將這部分行動列為第 2 級。該量表由第 1 級(最低)至第 6 級(最高);這部分行動雖然在多個平台發佈留言,但幾乎沒有跡象顯示它能突破原有傳播範圍,或主導回覆區。

相比之下,那些記者身份成功讓文章在多家媒體刊登,部分媒體更擁有大量追蹤者。例如,截至 2026 年 8 月,其中一家刊登該行動文章的網上媒體,在 Facebook 有近 200 萬名追蹤者,在 X 有近 355,000 名,在 Instagram 則超過 544,000 名。由於這部分行動持續成功將內容傳播至多家媒體,我們會將之評為第 4 級。