Bỏ qua nội dung chính
OpenAI

8 tháng 10, 2026

An toàn

Vô hiệu hóa các chiến dịch “bình phong” có AI hỗ trợ

Đang tải…

Trong hai năm rưỡi qua, chúng tôi đã báo cáo về nhiều cách thức mà các tác nhân đe dọa đã thử để dùng mô hình của chúng tôi thực hiện tấn công mạng, chiến dịch gây ảnh hưởng bí mật (IO), lừa đảo và các hành vi khác vi phạm Chính sách sử dụng của chúng tôi. Chúng tôi công bố các báo cáo này để cơ quan quản lý, các đơn vị cùng ngành và xã hội hiểu rõ những cách chúng tôi thấy tác nhân đe dọa tìm cách tận dụng AI, đồng thời làm sáng tỏ các điểm yếu mà họ muốn khai thác.

Gần đây, chúng tôi đã cấm hai chiến dịch gây ảnh hưởng — một từ Nga và một từ Iran — sử dụng mô hình của chúng tôi kết hợp với kỹ thuật và công nghệ truyền thống để hỗ trợ các thực thể “bình phong” tinh vi. Họ dùng các thực thể đó để che giấu nguồn gốc thông điệp về địa chính trị và xung đột trước khi đưa đến công chúng mục tiêu. Chiến dịch của Iran sử dụng bảy nhân vật “nhà báo” để chào các bài viết dài với những cơ quan báo chí trực tuyến vừa và nhỏ khắp thế giới; chiến dịch của Nga dường như đã lôi kéo những người không hay biết ở Mỹ Latinh vận hành một “viện nghiên cứu” tại chỗ.

Cả hai chiến dịch đều hoạt động trên nhiều hướng, thử nhiều chiến thuật khác nhau để đạt mục tiêu. Ngoài các bài viết dài, chiến dịch của Iran còn tạo hàng loạt bình luận mạng xã hội, chủ yếu về các chủ đề liên quan đến chiến tranh Mỹ–Iran. Ngoài việc kiểm soát “viện nghiên cứu”, chiến dịch của Nga còn tạo các tài liệu “rò rỉ” giả và kịch bản âm thanh; chúng tôi đã tìm thấy một số nội dung đó được phát tán trên mạng. Cả hai cũng dùng AI rất nhiều để soạn báo cáo nội bộ (đây là việc chiến dịch của Nga làm nhiều nhất); trong cả hai trường hợp, họ dùng các phương pháp đáng ngờ hoặc hoàn toàn gian dối để phóng đại hiệu quả của nhóm điều hành.

Điểm nổi bật nhất là các chiến dịch này rất giống những chiến dịch gây ảnh hưởng phức tạp thời trước AI, nhưng dùng AI để đơn giản hóa một số quy trình. Các nhân vật nhà báo do chiến dịch Iran điều khiển có nhiều nét tương đồng với nhà báo giả “Alice⁠(mở trong cửa sổ mới) Donovan⁠(mở trong cửa sổ mới)”, một bình phong của tình báo quân sự Nga có bài viết được nhiều cơ quan báo chí phương Tây đăng trong giai đoạn 2016–2017. Năm 2020, những cá nhân liên quan đến các hoạt động trước đó của Cơ quan Nghiên cứu Internet Nga đã vận hành một cơ quan “tin tức” giả mang tên “PeaceData⁠(mở trong cửa sổ mới)”, lôi kéo các nhà báo khắp thế giới viết bài mà không biết bản chất thật của tổ chức này.

Các chiến dịch này còn khác thường ở khả năng tiếp cận công chúng. Dựa trên Thang đo mức độ lan tỏa⁠(mở trong cửa sổ mới), xếp hạng chiến dịch gây ảnh hưởng từ 1 (thấp nhất) đến 6 (cao nhất), chúng tôi đánh giá chiến dịch có nguồn gốc từ Nga thuộc Cấp 5. Đây là chiến dịch Cấp 5 đầu tiên chúng tôi vô hiệu hóa kể từ khi bắt đầu công bố báo cáo. Chiến dịch có nguồn gốc từ Iran đạt Cấp 4. Cả hai đều đưa được nội dung của mình (không phải tất cả đều do mô hình của chúng tôi tạo) lên các cơ quan truyền thông chính thống, thay vì chỉ đăng trên mạng xã hội. Điều này phù hợp với một xu hướng chúng tôi quan sát được trong 30 chiến dịch gây ảnh hưởng bí mật đã vạch trần trong hai năm rưỡi qua: những chiến dịch tìm cách đưa nội dung lên báo chí có thật, thay vì dựa vào tài khoản giả trên mạng xã hội, thường có khả năng tiếp cận và tác động lớn nhất.

Ma trận 30 chiến dịch gây ảnh hưởng theo phương thức phân phối chính và cấp trên Thang đo mức độ lan tỏa. Chiến dịch sử dụng ấn phẩm bên ngoài đạt cấp 4 và 5; chiến dịch chủ yếu dùng mạng xã hội đạt cấp 1 đến 3.

Ma trận 30 chiến dịch gây ảnh hưởng chúng tôi đã vạch trần từ đầu năm 2024, đánh giá theo phương thức phân phối chính (mạng xã hội, website do chiến dịch vận hành, ấn phẩm bên ngoài) và điểm trên Thang đo mức độ lan tỏa. Những chiến dịch dùng nhiều phương thức, chẳng hạn vận hành website rồi quảng bá trên mạng xã hội, được phân loại theo phương thức có vẻ là trọng tâm hoạt động.

AI có thể giúp các chiến dịch bình phong như vậy mở rộng quy mô, nâng cao hiệu suất, độ lưu loát ngôn ngữ và năng lực biên tập. Nhóm điều hành có thể dùng những lợi thế này để lợi dụng các nạn nhân không nghi ngờ, như nhân viên hoặc biên tập viên, rồi đưa nội dung đến công chúng hoàn toàn không biết ai đứng sau hay động cơ của họ là gì. Các chiến dịch này cũng cho thấy mức độ phức tạp và tinh vi trong cách tác nhân đe dọa dùng danh tính và tổ chức giả để đạt mục tiêu. Để các tổ chức duy trì khả năng phòng vệ vững chắc, điều thiết yếu là hiểu những điểm yếu bị khai thác và cách chúng giúp tác nhân đe dọa tiếp cận thêm công chúng, mở rộng phạm vi lan truyền.

Nhưng chính tính chất bí mật cũng khiến các chiến dịch bình phong này đặc biệt dễ bị tổn hại khi thông tin được công bố có trách nhiệm. Cả “Alice Donovan” và “PeaceData” đều ngừng hoạt động sau khi bị vạch trần. Vì vậy, mục tiêu của chúng tôi khi báo cáo về các chiến dịch bình phong này là tạo thuận lợi cho việc nghiên cứu và vô hiệu hóa tiếp theo, đồng thời khiến việc tiếp tục vận hành chúng khó khăn hơn.

Nga: Chiến dịch “Dark Clark”

Các tác nhân có nguồn gốc từ Nga tiến hành chiến dịch gây ảnh hưởng trên khắp Mỹ Latinh.

Chủ thể thực hiện

Chúng tôi đã cấm một nhóm tài khoản ChatGPT có nguồn gốc từ Nga. Họ dùng ChatGPT cho nhiều công việc liên quan đến các chiến dịch gây ảnh hưởng bí mật nhắm vào các quốc gia khắp Mỹ Latinh. Phần lớn hoạt động dường như nhằm làm tổn hại uy tín Ukraine trong khu vực, nhưng một số có vẻ nhằm tác động đến kết quả chính trị tại địa phương, nhất là ở Argentina và Bolivia. Hầu hết người điều hành nhập câu lệnh bằng tiếng Nga; một người dùng tiếng Tây Ban Nha nhưng vẫn có vẻ đang ở Nga. Chúng tôi đã chia sẻ thông tin về vụ việc với các cơ quan chức năng liên quan.

Nhóm điều hành dùng ChatGPT cho ba nhiệm vụ chính: viết báo cáo nội bộ về hoạt động của họ (và hoạt động của người khác mà họ có thể nhận công một cách có vẻ hợp lý), tạo nội dung cho các chiến dịch và soạn báo cáo về hiệu quả của một tổ chức tự xưng là “nền tảng nghiên cứu” tại Mỹ Latinh mang tên Trung tâm Nghiên cứu Xã hội (SRC). Họ dường như kiểm soát SRC thông qua danh tính giả “Mia Clark”; dựa theo tên này, chúng tôi gọi chiến dịch là “Dark Clark”. Vì chúng tôi không cho phép truy cập mô hình từ Nga, họ dùng VPN để kết nối với dịch vụ của chúng tôi.

Trong báo cáo nội bộ, nhóm điều hành tuyên bố đã phát tán các câu chuyện bịa đặt khắp Mỹ Latinh để làm tổn hại Ukraine hoặc các lãnh đạo địa phương. Một số nội dung giả mạo này được các nhà nghiên cứu⁠(mở trong cửa sổ mới) nguồn mở⁠(mở trong cửa sổ mới) quy cho một tổ chức Nga có tên “Politology” hoặc “La Compania”, được cho là kế thừa Tập đoàn Wagner và các tổ chức khác do nhà tài phiệt Nga Yevgeniy Prigozhin thành lập. Nhóm điều hành cũng yêu cầu mô hình của chúng tôi dịch hoặc giải thích các tin bài công khai về Politology và Wagner, nhiều hơn hẳn so với bất kỳ mạng lưới nào khác có nguồn gốc từ Nga.

Chiến dịch này khác thường ở hai điểm. Thứ nhất, chiến dịch dường như đã lôi kéo thành công những cá nhân ở Mỹ Latinh vào làm việc cho SRC. Báo cáo của nhóm điều hành Nga về SRC đề cập đến quyết định về thang lương, tuyển dụng và sa thải, cho thấy họ kiểm soát tổ chức này chứ không chỉ hợp tác. Bằng chứng hiện có cho thấy nhân viên SRC tại Mỹ Latinh không biết mình đang làm việc cho một nhóm của Nga. Khác với một “viện nghiên cứu” có liên hệ với Nga mà chúng tôi mới vạch trần, SRC dường như tạo ra phần lớn nội dung gốc thông qua những nhân viên bị lôi kéo. Đây là nỗ lực vận hành một danh tính bình phong phức tạp nhất mà chúng tôi đã vô hiệu hóa trong hai năm rưỡi qua.

Thứ hai, một số bằng chứng nguồn mở cho thấy nội dung giả mạo của Dark Clark lan rộng đến mức dẫn tới các bài kiểm chứng⁠(mở trong cửa sổ mới) và tuyên bố phủ nhận chính thức⁠(mở trong cửa sổ mới). Mức độ thâm nhập này vượt mọi chiến dịch gây ảnh hưởng chúng tôi đã vô hiệu hóa trong hai năm qua. Một nội dung giả mạo mà chiến dịch tuyên bố đã cài cắm tại Peru thậm chí còn góp phần làm gia tăng căng thẳng công khai giữa Ukraine và Ba Lan.

Báo cáo nội bộ

Nhóm điều hành chủ yếu dùng ChatGPT để soạn và cập nhật báo cáo nội bộ gửi một cấp trên chưa rõ danh tính. Các báo cáo định kỳ này mô tả nỗ lực tiến hành các chiến dịch gây ảnh hưởng bí mật khắp Mỹ Latinh. Báo cáo bao quát ba mảng chính: bôi nhọ Ukraine và cản trở tuyển quân cho Lực lượng Vũ trang Ukraine; can thiệp vào chính trị nội bộ một số nước, nhất là Bolivia và Argentina; và quản lý SRC. Trong phần lớn trường hợp, chúng tôi không thấy các tác nhân đe dọa dùng mô hình để tạo nội dung cho chiến dịch mà chỉ để báo cáo về chúng (một vài ngoại lệ được mô tả bên dưới⁠).

Các báo cáo có nhiều chi tiết chiến thuật, làm rõ cách chiến dịch tìm cách làm tổn hại Ukraine và một số lãnh đạo quốc gia, đặc biệt là tổng thống Argentina, Bolivia và Ecuador. Một số báo cáo mô tả nỗ lực lừa người dân địa phương thực hiện những hoạt động mà nhóm điều hành có thể lợi dụng; số khác mô tả các tài liệu “rò rỉ” giả mà họ tuyên bố đã phát tán.

Trong hai trường hợp, bằng chứng liên hệ nhóm điều hành với các tin bài công khai về “Politology”. Họ báo cáo rằng năm 2024 đã tiến hành hai chiến dịch nhắm vào Tổng thống Argentina Javier Milei. Thứ nhất, họ nói đã phát tán tin giả rằng Milei mua vòng cổ Cartier nạm đá quý cho chó của mình. Thứ hai, họ tuyên bố đã trả tiền cho người địa phương vẽ graffiti chống Milei tại Buenos Aires. Dựa trên tài liệu rò rỉ, cả hai hoạt động này đã được công khai⁠(mở trong cửa sổ mới) quy cho⁠(mở trong cửa sổ mới) “Politology” và “La Compania”.

Còn nhiều nội dung giả mạo khác trước đây chưa được xác định có liên quan đến các chiến dịch gây ảnh hưởng của Nga. Ví dụ, những người điều hành tuyên bố rằng vào tháng 5/2026, họ đã tạo một địa chỉ email giả mạo cơ quan quản lý giáo dục khu vực tại Lima, Peru. Họ dùng địa chỉ này để chỉ đạo các trường trong khu vực tổ chức sự kiện về Ukraine nhân Ngày Đa dạng Văn hóa và Ngôn ngữ của quốc gia (21/5). Các email chỉ dẫn rõ phải nhắc đến một số nhân vật, trong đó có Stepan Bandera, nhà dân tộc chủ nghĩa Ukraine gây tranh cãi trong thế kỷ XX. Một bộ phận người Ukraine xem ông là biểu tượng đấu tranh giành độc lập, nhưng tại Nga và Ba Lan, ông gắn liền với chủ nghĩa phát xít, việc cộng tác với kẻ thù thời chiến và các hành vi tàn bạo. Theo những người điều hành, một số trường đã trả lời địa chỉ email giả, xác nhận đã tổ chức các sự kiện như vậy và thậm chí gửi cả ảnh.

Sau đó, họ tuyên bố đã cài cắm tin bài về các sự kiện này vào truyền thông Peru và Ba Lan, kèm cáo buộc Ukraine đang “xuất khẩu” tư tưởng dân tộc cực đoan, gây ra làn sóng phẫn nộ. Qua tìm kiếm nguồn mở, chúng tôi tìm thấy các tin bài khớp với tuyên bố này trên báo chí⁠(mở trong cửa sổ mới) Peru⁠(mở trong cửa sổ mới) và⁠(mở trong cửa sổ mới) Ba Lan⁠(mở trong cửa sổ mới), cùng một ấn phẩm tiếng Anh tại Hungary⁠(mở trong cửa sổ mới) (một số bài viết sau đó đã bị xóa). Một số⁠(mở trong cửa sổ mới) bài viết⁠(mở trong cửa sổ mới) dẫn phản ứng của một nghị sĩ Ba Lan tại Nghị viện châu Âu, đề xuất tuyên bố những người có biểu hiện “bài Ba Lan” là người không được hoan nghênh tại Ba Lan. Như vậy, nội dung giả mạo của Nga vừa khai thác vừa khoét sâu những căng thẳng lịch sử giữa người Ukraine và người Ba Lan.

Tương tự, vào tháng 6, những người điều hành tuyên bố đã dùng một địa chỉ email giả khác để lừa các trường ở Ecuador tổ chức lễ tuyên thệ trung thành với Tổng thống Daniel Noboa và Erik Prince, cựu lãnh đạo nhà thầu quân sự tư nhân Blackwater. Họ tuyên bố vụ việc đã gây phẫn nộ tại Ecuador và tạo áp lực buộc chính phủ phải bác bỏ thông tin giả, qua đó khiến thông tin này lan rộng trên toàn quốc. Một lần nữa, nghiên cứu nguồn mở tìm thấy các tin⁠(mở trong cửa sổ mới) bài⁠(mở trong cửa sổ mới) trên báo chí⁠(mở trong cửa sổ mới) Ecuador⁠(mở trong cửa sổ mới) có nội dung rất sát với tuyên bố này, và thậm chí cả một phản bác chi tiết⁠(mở trong cửa sổ mới) của Bộ trưởng Giáo dục Ecuador.

Những người điều hành dùng nhiều thủ thuật để củng cố các câu chuyện bịa đặt của mình. Theo báo cáo nội bộ, họ đã phát tán hai nội dung giả mạo khác nhau nhắm vào Ecuador trong tháng 3. Một nội dung sử dụng đoạn ghi âm giả mạo lãnh sự Ukraine tại Ecuador, trong đó ông bị cho là đã đưa ra những bình luận miệt thị người Ecuador. Cuộc điều tra nguồn mở của chúng tôi tìm thấy một bài đăng TikTok khớp chính xác với tuyên bố này; bài đăng dường như chỉ nhận được ít tương tác. Nội dung còn lại là một video giả được phát tán trên X và TikTok, gắn logo của một kênh tin tức có thật, cáo buộc chính phủ Noboa đang tuyển nam thanh niên sang chiến đấu tại Ukraine. Các bên kiểm chứng thông tin⁠(mở trong cửa sổ mới) tại Ecuador đã mô tả một chiến dịch khớp với nội dung này vào đầu tháng 4.

Ảnh chụp TikTok đã che thông tin về bài đăng ngày 8/4/2026, phát tán đoạn ghi âm giả mạo lãnh sự Ukraine tại Ecuador.

Video TikTok đăng ngày 8/4/2026, chứa đoạn ghi âm giả được gán cho lãnh sự Ukraine mà chiến dịch này tuyên bố đã tạo ra.

Một báo cáo nội bộ khác mô tả nội dung giả mạo họ phát tán tại Bolivia vào cuối tháng 5, khi các cuộc biểu tình chống chính phủ lên đến đỉnh điểm. Những người điều hành nêu rõ mục tiêu của chiến dịch là làm trầm trọng thêm cuộc khủng hoảng xoay quanh các cuộc biểu tình. Chiến dịch sử dụng một đoạn ghi âm giả mạo nhân viên công ty cấp nước nhà nước EPSAS, nói rằng chính phủ sắp cắt nước tại thủ đô hành chính La Paz và ban bố tình trạng khẩn cấp. Nghiên cứu nguồn mở của chúng tôi tìm thấy một bài bác bỏ⁠(mở trong cửa sổ mới) thông tin trùng khớp và một tuyên bố phủ nhận chính thức⁠(mở trong cửa sổ mới) từ EPSAS.

Các báo cáo nội bộ khác có đề cập đến những nội dung giả mạo mà chúng tôi không thể xác minh qua nguồn mở, có thể vì chúng đã bị gỡ hoặc không lan truyền được. Ví dụ, những người điều hành tuyên bố đã phát tán một câu chuyện vào tháng 1, cáo buộc một người mẫu kiêm người có ảnh hưởng trên mạng xã hội ở Brazil đã bị đại diện Đại sứ quán Ukraine buôn sang Ukraine rồi bị sát hại tại Kyiv. Vào tháng 6, họ tuyên bố đã phát tán một đoạn ghi âm giả khác tại Bolivia, lần này mạo danh nhân viên Ngân hàng Trung ương Bolivia, cảnh báo ngân hàng sắp hạn chế rút tiền mặt. Họ cũng tuyên bố đã phát tán một lá thư giả mạo cơ quan quản lý dầu khí của nước này, cảnh báo về việc hạn chế bán nhiên liệu cho ô tô cá nhân.

Trong các báo cáo khác, những người điều hành yêu cầu mô hình của chúng tôi giúp tìm các vụ việc ở quốc gia mục tiêu mà họ có thể nhận công, ngay cả khi không tham gia. Ví dụ, tại Argentina, họ tuyên bố Ngoại trưởng Argentina đã trích dẫn nội dung của chiến dịch trong một cuộc họp ủy ban Liên Hợp Quốc về quần đảo Falkland/Malvinas. Họ nhận công đã gieo rắc các lập luận rằng nguyên tắc tự quyết không áp dụng cho quần đảo này và Anh duy trì sự hiện diện quân sự quá mức tại đây. Thực tế, cả hai lập luận đều đã nằm trong lập trường chính thức của Argentina suốt nhiều⁠(mở trong cửa sổ mới) năm⁠(mở trong cửa sổ mới). Tương tự, vào tháng 6, truyền thông Brazil đưa tin⁠(mở trong cửa sổ mới) về một công dân Brazil sang Ukraine nhập ngũ, bị lực lượng Nga bắt giữ rồi xuất hiện trên truyền hình, tuyên bố mình đã bị lừa đi chiến đấu. Nhóm sử dụng ChatGPT tìm cách khẳng định rằng bản tin này đã lặp lại thông điệp của chiến dịch; thực tế, bản tin trích dẫn chính video của người bị bắt⁠(mở trong cửa sổ mới). Điều này cho thấy những người điều hành đang cố tiến hành một chiến dịch gây ảnh hưởng nhắm vào chính bên thuê mình, thay vì bất kỳ công chúng bên ngoài nào.

“Nền tảng nghiên cứu”

Một số báo cáo của nhóm điều hành nhắc đến một tổ chức tự xưng là “nền tảng nghiên cứu”, mang tên Trung tâm Nghiên cứu Xã hội (tiếng Nga cũng có nghĩa là Trung tâm Nghiên cứu Xã hội học). Theo website của SRC, trung tâm tập trung vào cộng đồng người Ấn Độ tại Mỹ Latinh và quan hệ giữa Ấn Độ với các nước trong khu vực.

Các báo cáo nội bộ cho thấy nhóm điều hành kiểm soát viện nghiên cứu này, chứ không đơn thuần hợp tác với nó. Chẳng hạn, họ đề cập đến quyết định tuyển dụng và sa thải, thang lương, kế hoạch nhân sự và các dự án nghiên cứu đang triển khai. Quan trọng hơn, báo cáo còn nêu rằng nhóm điều hành đã tạo một danh tính giả mang tên “Mia Clark” để quản lý hoạt động mạng xã hội của chiến dịch và liên hệ với nhân viên tại Mỹ Latinh. Bằng chứng hiện có cho thấy những nhân viên tại chỗ này không hề biết mình đang làm việc cho một chiến dịch của Nga và đã thực hiện công việc nghiên cứu một cách thiện chí. Việc dùng những người không hay biết làm bình phong rất giống chiến dịch “PeaceData” trước đây của Nga, cũng có liên hệ với mạng lưới của Prigozhin, mà Meta đã vạch trần⁠(mở trong cửa sổ mới) năm 2020.

Theo báo cáo của nhóm điều hành Nga, nhân viên của họ tại Mỹ Latinh đã phỏng vấn các chuyên gia và nhà bình luận khắp khu vực, rồi soạn các bài nghiên cứu dựa trên kết quả thu thập được. Chủ đề trải từ phân tích tổng quan dư luận về nhóm BRICS đến so sánh chi tiết nền kinh tế Brazil dưới thời hai tổng thống Jair Bolsonaro và Luiz Inácio Lula da Silva. Đôi khi, nhóm điều hành Nga soạn báo cáo tiến độ về các dự án nghiên cứu trước khi kết quả được công bố, cho thấy họ tham gia sát sao vào quá trình thực hiện. Chúng tôi tìm thấy hơn 60 bài viết trên website SRC, phần lớn có vẻ là nội dung tự biên soạn. Điều này khác với một chiến dịch có nguồn gốc từ Nga mà chúng tôi mới vạch trần: chiến dịch đó cũng dùng viện nghiên cứu làm bình phong nhưng đạo văn phần lớn nội dung. Dark Clark dường như muốn xây dựng một tổ chức bình phong bền vững hơn, có quan hệ trên khắp Mỹ Latinh.

Để quảng bá công việc của SRC, nhóm điều hành Nga tuyên bố đã tìm cách xây dựng một mạng lưới tài khoản và trang mạng xã hội. Theo báo cáo của họ, hoạt động này gặp trục trặc khi những người điều hành ở nhiều nơi trên thế giới cùng cố truy cập một tài khoản, khiến tài khoản bị hạn chế. Dấu vết của việc này xuất hiện trong dữ liệu nguồn mở: chẳng hạn, mục minh bạch của tài khoản SRC chính trên X hiển thị vị trí tại Đức (có thể do dùng VPN) nhưng kết nối qua App Store Liên bang Nga, còn mục minh bạch của một tài khoản Instagram hiển thị quản trị viên ở Venezuela. Cả ba tài khoản Facebook mang thương hiệu SRC mà chúng tôi tìm thấy đều chưa đủ người theo dõi để hiển thị thông tin vị trí quản trị viên.

Ảnh chụp thông tin minh bạch tài khoản của Trung tâm Nghiên cứu Xã hội: tài khoản X kết nối qua App Store Liên bang Nga, còn tài khoản Instagram ghi vị trí tại Venezuela.

Bên trái là tài khoản X liên quan đến Trung tâm Nghiên cứu Xã hội. Lưu ý mục minh bạch cho thấy tài khoản kết nối qua cửa hàng ứng dụng Liên bang Nga. Bên phải là tài khoản Instagram của SRC: lưu ý vị trí tại Venezuela.

Nhóm điều hành báo cáo những khó khăn riêng trên LinkedIn: họ nói đã tạo một tài khoản mà chính họ xác nhận là giả để đại diện SRC, nhưng sau đó gặp khó khi xây dựng mạng lưới cho tài khoản này. Theo báo cáo, giải pháp là tạo thêm tài khoản giả để theo dõi tài khoản đầu tiên, khiến nó trông đáng tin hơn. Tính đến ngày 17/8, một tài khoản LinkedIn cùng mang thương hiệu Trung tâm Nghiên cứu Xã hội có 961 người theo dõi và tự khai quy mô 200–500 nhân viên, nhưng chỉ liệt kê hai người.

Tạo nội dung giả mạo

Thỉnh thoảng, ngoài dùng AI cập nhật báo cáo, nhóm điều hành còn yêu cầu mô hình giúp xây dựng và soạn văn bản để sử dụng trong chiến dịch: chẳng hạn, bảo đảm nội dung giả mạo dùng đúng giọng điệu, từ vựng và văn phong cơ quan của từng quốc gia. Việc này chỉ chiếm tỷ lệ khá nhỏ trong tổng khối lượng công việc, có lẽ vì chiến dịch dường như có ít nhất một người bản ngữ tiếng Tây Ban Nha từ Mỹ Latinh nên ít cần AI hỗ trợ ngôn ngữ hơn.

Ví dụ, có lần một người điều hành nói tiếng Nga yêu cầu mô hình giúp soạn bằng tiếng Nga một lá thư nhằm gắn lãnh sự danh dự Ukraine tại Panama với tham nhũng. Sau đó, người điều hành nói tiếng Tây Ban Nha yêu cầu mô hình dịch thư sang tiếng Tây Ban Nha và tạo kịch bản âm thanh đi kèm. Một ảnh có nội dung khớp với lá thư, kèm lời thuyết minh khớp kịch bản của người điều hành, được đăng lên TikTok bằng tài khoản tự nhận là một cơ quan tin tức nhưng dùng logo của TVN Noticias⁠(mở trong cửa sổ mới) tại Panama. Kênh TikTok này chỉ có một người theo dõi và ngừng đăng sau khi tung nội dung giả mạo đó.

Ảnh chụp TikTok đã che thông tin, hiển thị thư giả về liên hệ của Ukraine với lĩnh vực tài chính Panama, kèm lời thuyết minh do chiến dịch tạo.

Bài đăng TikTok hiển thị lá thư có nội dung do chiến dịch tạo, kèm kịch bản thuyết minh cũng do chiến dịch tạo.

Trong một lần khác, người điều hành nói tiếng Tây Ban Nha tại Nga đưa cho mô hình một kịch bản tiếng Nga cáo buộc Noboa xúc phạm người nghèo Ecuador và yêu cầu dịch sang tiếng Tây Ban Nha dùng tại Ecuador. Lần thứ ba, vào tháng 3, cùng người dùng này yêu cầu mô hình soát lỗi bản thảo hợp đồng tiếng Tây Ban Nha giữa công ty “International Security Solutions FZE” và một cá nhân ở Ecuador, được cho là để cung cấp dịch vụ cơ sở hạ tầng tại Ukraine. Các câu hỏi tập trung vào cách cải thiện ngôn ngữ và bố cục, kể cả hỏi những từ nào nên in đậm.

Người dùng ngừng gửi câu lệnh về hợp đồng sau khi chốt câu chữ. Tuy nhiên, nghiên cứu nguồn mở cho thấy ảnh chụp “hợp đồng” sau đó được lan truyền trên mạng xã hội⁠(mở trong cửa sổ mới). Nó được dùng để củng cố cáo buộc chính phủ Noboa hợp tác với một công ty bình phong nhằm lừa người Ecuador gia nhập quân đội Ukraine. Nội dung giả lan rộng đến mức dẫn tới một bài kiểm chứng⁠(mở trong cửa sổ mới) đầu tháng 4: các bên kiểm chứng kết luận công ty này “không có trong sổ đăng ký của Cơ quan Giám sát Công ty, Chứng khoán và Bảo hiểm Ecuador”.

Tác động

Tác động của chiến dịch này cần được đánh giá đặc biệt thận trọng. Như đã nêu, một cách làm chính của nhóm điều hành là nhận công về những hoạt động không liên quan gì đến chiến dịch của họ. Vì vậy, không thể mặc nhiên tin những tuyên bố về tác động mà họ đưa ra trong báo cáo nội bộ. Tương tự, một số câu chuyện giả mà họ tuyên bố đã cài cắm không xuất hiện trong nghiên cứu nguồn mở, có thể vì được phát tán qua kênh không công khai, đã bị gỡ hoặc thực tế chưa từng được đăng.

Tuy nhiên, bằng chứng nguồn mở cho phép chúng tôi xác minh một số tuyên bố của họ. Một số nội dung giả mà chiến dịch tuyên bố đã phát tán sau đó được các bên kiểm chứng đưa tin và các chính phủ bác bỏ, cho thấy chúng đã lan đủ rộng để cần có phản hồi. Trong các trường hợp khác, chúng tôi tìm được nội dung trên mạng rất sát với nội dung do chiến dịch tạo. Đáng chú ý nhất, vụ việc mà chiến dịch tuyên bố đã lừa một trường ở Peru tổ chức sự kiện có hình ảnh Bandera sau đó được đưa tin tại cả Mỹ Latinh lẫn châu Âu và dường như đã khiến ít nhất một nghị sĩ Ba Lan tại Nghị viện châu Âu lên tiếng.

Dựa trên Thang đo mức độ lan tỏa⁠(mở trong cửa sổ mới), xếp hạng chiến dịch gây ảnh hưởng từ 1 (thấp nhất) đến 6 (cao nhất), chúng tôi đánh giá chiến dịch này thuộc Cấp 5, với bằng chứng cho thấy nó đã khiến các chính trị gia ở một số nước công khai lên tiếng. Đây là chiến dịch Cấp 5 đầu tiên chúng tôi vô hiệu hóa kể từ khi bắt đầu công bố báo cáo.

Iran: Chiến dịch “Bút danh giả”

Chiến dịch có nguồn gốc từ Iran cài cắm các bài viết dài dưới bút danh giả vào các cơ quan báo chí trực tuyến.

Chủ thể thực hiện

Chúng tôi đã cấm một nhóm tài khoản ChatGPT có nguồn gốc từ Iran. Họ nhập câu lệnh bằng tiếng Ba Tư và tạo nội dung bằng tiếng Ba Tư cùng tiếng Anh. Các tác nhân che giấu vị trí bằng cách dùng VPN để truy cập ChatGPT.

Chiến dịch dùng mô hình của chúng tôi để trau chuốt bài viết dài và thư chào bài, tạo bình luận mạng xã hội và hoàn thiện báo cáo nội bộ. Nhóm điều hành dùng bảy bút danh khác nhau để chào bài, nên chúng tôi đặt tên chiến dịch là “Bút danh giả”. Các bài viết dài tập trung vào xung đột Mỹ–Iran. Phần lớn bình luận cũng nói về cuộc xung đột; một số ít đề cập chính trị Mỹ, thường trong bối cảnh rộng hơn của cuộc xung đột.

Tác động có thể quan sát được của các mảng hoạt động chính khác nhau đáng kể. Chúng tôi tìm thấy gần 100 bài viết được đăng hoặc đăng lại dưới các bút danh của chiến dịch trên khoảng một chục cơ quan báo chí trực tuyến khắp thế giới. Đây là các cơ quan báo chí vừa và nhỏ, thường tập trung vào thời sự quốc tế, địa chính trị và các sự kiện ở Trung Đông. Ngược lại, dường như không bình luận mạng xã hội nào tạo ra lượng tương tác đáng kể qua lượt thích, chia sẻ hay phản hồi tiếp theo. Thực tế, báo cáo nội bộ của nhóm điều hành dùng một cách tính sai lệch để đo tác động trên mạng xã hội, có thể nhằm thổi phồng hiệu quả hoạt động của họ.

Nhìn chung, hoạt động này có vẻ phù hợp với một chủ thể thương mại thực hiện chiến dịch gây ảnh hưởng thuê, nhưng chúng tôi chưa thể xác định cụ thể chủ thể đó. Chúng tôi đã chia sẻ thông tin về vụ việc với các cơ quan chức năng liên quan.

Cài cắm bài viết

Hoạt động có sức lan tỏa lớn nhất của chiến dịch là yêu cầu ChatGPT rà soát và trau chuốt các bài viết dài bằng tiếng Anh về khía cạnh địa chính trị của xung đột Mỹ–Iran. Các câu lệnh thường yêu cầu mô hình đánh giá bản thảo tiếng Anh theo tiêu chí nhận bài của một cơ quan báo chí trực tuyến cụ thể và đề xuất chỉnh sửa để đáp ứng tiêu chí đó. Sau khi duyệt chỉnh sửa, nhóm điều hành yêu cầu mô hình soạn email để họ chào bài với biên tập viên của cơ quan báo chí đó.

Các thư chào bài được soạn dưới bảy bút danh giả khác nhau: Ervin B. Hoskins, Noah Lamington, Sophia Gonzalez, Michael Harrison, Ericka Feusier, Jenny Williams và Alice Johnson. Theo tiểu sử đăng kèm một số bài viết, mỗi nhân vật đều tự nhận là nhà báo phương Tây (thường là người Mỹ, riêng tiểu sử Noah Lamington nói ở New Zealand), thường chuyên về chính trị quốc tế, Trung Đông, nhân quyền hoặc xung đột. Với nhân vật “Michael Harrison”, nhóm điều hành còn yêu cầu mô hình viết cả tiểu sử. (Đáng chú ý, vào tháng 3, Meta đã vô hiệu hóa⁠(mở trong cửa sổ mới) một chiến dịch gây ảnh hưởng của Iran cũng sử dụng một nhân vật nhà báo mang tên “Michael Harrison”.)

Một số danh tính giả được củng cố bằng tài khoản trên nhiều nền tảng mạng xã hội. Ví dụ, nhân vật Michael Harrison có tài khoản hỗ trợ trên Medium, X và Facebook. Nhân vật Ervin B. Hoskins có tài khoản trên X, Facebook, Instagram và Threads. Tiểu sử nhân vật này tự nhận là “cây bút tự do người Mỹ”, nhưng thông tin minh bạch trên mạng xã hội cho thấy các tài khoản ở Iran.

Phần tiểu sử Instagram của nhân vật giả Ervin Hoskins và các bảng thông tin minh bạch tài khoản. X ghi ứng dụng Android Tây Á, còn Instagram ghi vị trí tài khoản tại Iran.

Phía trên là tiểu sử Instagram của nhân vật Ervin Hoskins. Dưới bên trái là thông tin minh bạch tài khoản X, cho thấy việc sử dụng ứng dụng Android Tây Á. Dưới bên phải là thông tin minh bạch tài khoản Instagram, hiển thị vị trí tại Iran. Meta đã cấm tài khoản Instagram này vào tháng 8.

Bằng các kỹ thuật điều tra nguồn mở, chúng tôi tìm thấy gần 100 bài viết được đăng dưới những bút danh của nhóm điều hành trên hơn một chục ấn phẩm khác nhau. Các ấn phẩm này thường tập trung vào thời sự quốc tế, địa chính trị và sự kiện ở Trung Đông, đôi khi theo quan điểm phản chiến hoặc cấp tiến. Bài sớm nhất chúng tôi tìm thấy được đăng vào tháng 7/2025, bài muộn nhất vào tháng 10/2026. Tần suất đăng bài tăng mạnh sau khi xung đột Mỹ–Iran bùng nổ.

Dòng thời gian các bài viết được đăng dưới tên bảy nhân vật giả của chiến dịch Bút danh giả, phân theo chủ đề và tác giả. Tin bài về Mỹ–Iran chiếm phần lớn nhất và bắt đầu tập trung dày đặc từ tháng 3/2026.

Dòng thời gian các bài viết theo tác giả và chủ đề, tháng 7/2025–tháng 9/2026. Lưu ý mật độ bài viết về quan hệ Mỹ–Iran từ tháng 3/2026 trở đi.

Năm tiêu đề bài viết được đăng dưới tên các nhân vật giả liên quan đến chiến dịch: Alice Johnson, Noah Lamington, Michael Harrison, Sophia Gonzalez và Ervin Hoskins.

Một số tiêu đề bài viết được đăng dưới các bút danh liên quan đến chiến dịch này trên nhiều cơ quan báo chí trực tuyến từ tháng 2 đến tháng 7/2026.

Ít nhất một số bài viết sau đó được quảng bá qua tài khoản mạng xã hội của các cơ quan báo chí tương ứng, có thể giúp nhóm điều hành Iran tiếp cận những độc giả mà họ vốn không thể vươn tới.

Bình luận hàng loạt

Bên cạnh các bài viết, những tác nhân đe dọa yêu cầu ChatGPT tạo hàng loạt bình luận bằng tiếng Anh hoặc tiếng Ba Tư về chủ đề địa chính trị hoặc chính trị. Cách làm điển hình là nhập văn bản hoặc ảnh chụp một bài đăng mạng xã hội, rồi yêu cầu mô hình tạo một loạt câu trả lời phù hợp với định hướng chung của họ. Sau đó, các câu trả lời được đăng lên mạng, thường chỉ cách nhau vài phút. Báo cáo nội bộ của nhóm điều hành đề cập cả việc đăng thủ công lẫn tự động; chúng tôi không có bằng chứng cho thấy việc tự động hóa được thực hiện với sự hỗ trợ của các mô hình của chúng tôi.

Ảnh chụp đặt cạnh nhau của các câu trả lời bằng tiếng Anh và tiếng Ba Tư do chiến dịch tạo, đăng trong tháng 7; danh tính tài khoản đã được che.

Các bài đăng trên X bằng tiếng Anh ở bên trái và tiếng Ba Tư ở bên phải, do chiến dịch tạo và đăng trong tháng 7. Các bình luận tiếng Anh trả lời một bài đăng tiếng Anh cảnh báo Mỹ đang chuẩn bị “tấn công quy mô lớn” vào Iran. Tất cả bình luận trong hình này được đăng trong vòng 10 phút. Các bình luận tiếng Ba Tư trả lời một bài đăng tiếng Ba Tư về các cuộc tấn công của Mỹ vào Iran và được đăng trong vòng 13 phút.

Một phần hoạt động bình luận hàng loạt này là tạo câu trả lời cho các bài đăng mạng xã hội về chính các bài báo của chiến dịch. Nhóm điều hành nhập ảnh chụp bài đăng quảng bá bài viết của mình, rồi tạo các bình luận khen ngợi hoặc tán thành, có lẽ để khiến bài viết có vẻ được đón nhận rộng rãi hơn.

Ảnh chụp Facebook đã che thông tin, cho thấy một trang tin địa phương chia sẻ bài viết do chiến dịch tạo ra dưới tên Sophia Gonzalez, bên dưới là bốn bình luận cũng do chiến dịch tạo.

Bài đăng Facebook của một trang tin địa phương tại Mỹ chia sẻ bài viết do chiến dịch tạo, cùng các bình luận bên dưới cũng do chiến dịch tạo.

Phần lớn các đợt tạo bình luận tập trung rộng hơn vào xung đột giữa Iran, Mỹ và Israel. Người dùng yêu cầu bình luận về các chủ đề như tấn công tên lửa, ngừng bắn và các nước đi ngoại giao, đồng thời chỉ định nội dung phải khắc họa Mỹ là bên gây hấn, Israel là đồng minh không đáng tin của Mỹ, còn Iran là nạn nhân kiên cường, không chịu khuất phục. Nhóm điều hành tạo đặc biệt nhiều câu trả lời cho các bài đăng của Iran International, mạng truyền hình vệ tinh đặt tại Anh thường chỉ trích chính quyền Iran, với hơn hai chục đợt tạo câu trả lời mang tính công kích bằng tiếng Ba Tư. Một số ít đợt tạo nội dung nhắm đến bài đăng mạng xã hội về các vấn đề chính trị Mỹ, thường cũng đặt trong bối cảnh rộng hơn của cuộc xung đột.

Hai bình luận Instagram đã che thông tin, do chiến dịch tạo để trả lời các bài đăng về chính trị Mỹ.

Các bình luận Instagram do chiến dịch tạo để trả lời bài đăng về chính trị Mỹ.

Chúng tôi tìm thấy một số ít câu trả lời này được đăng trên mạng; nhiều câu khác không xuất hiện trong tìm kiếm nguồn mở, có thể vì chưa được đăng hoặc được đăng bằng tài khoản đã bị gỡ. (Ví dụ, ba nhân vật nhà báo — Ericka Feusier, Alice Johnson và Jenny Williams — ghi tên tài khoản X trong tiểu sử công khai: đến tháng 8/2026, tất cả đều đã bị đình chỉ.) Một số tài khoản có đăng bình luận mang tên có vẻ phương Tây, nhưng thông tin vị trí lại ở Iran.

Các bảng thông tin minh bạch tài khoản Instagram đã che thông tin, cho thấy cả hai tài khoản đăng những bình luận trước đó đều có vị trí tại Iran.

Mục minh bạch của các tài khoản Instagram đăng những bình luận minh họa phía trên, cho thấy chúng ở Iran.

Ở những nơi chúng tôi tìm thấy các câu trả lời này, chúng thường chỉ chiếm một phần nhỏ tổng số bình luận của bài đăng, cho thấy nhóm điều hành không lấn át được tiếng nói của người dùng thật. Chúng dường như cũng không thu hút tương tác đáng kể: thực tế, nhiều lượt thích cho câu trả lời của chiến dịch đến từ chính các tài khoản có liên hệ với chiến dịch. Chúng tôi đã chia sẻ thông tin về vụ việc với các đối tác trong ngành, những đơn vị có điều kiện tốt nhất để đánh giá toàn diện mức độ tương tác.

Báo cáo nội bộ

Nỗ lực khiến hoạt động của mình có vẻ được chú ý hơn không chỉ giới hạn ở các bài đăng công khai. Ngoài tạo nội dung, thỉnh thoảng nhóm điều hành còn yêu cầu ChatGPT trau chuốt những văn bản có vẻ là báo cáo nội bộ về chiến dịch mạng xã hội của họ. Thông thường, họ cung cấp cho mô hình một loạt số liệu rồi yêu cầu chuyển thành các bản trình bày chỉn chu.

Đây không phải chiến dịch đầu tiên chúng tôi vô hiệu hóa có dùng AI để viết báo cáo tự đánh giá⁠(mở trong cửa sổ mới) của mình⁠(mở trong cửa sổ mới). Điểm đáng chú ý nhất trong nỗ lực tự đánh giá thành tích của nhóm điều hành Iran là phương pháp họ sử dụng. Chỉ số “tác động” chính họ dùng là số lượt xem của bài đăng mà họ trả lời (không phải lượt xem của chính câu trả lời), được đếm trước và một khoảng thời gian không xác định sau khi câu trả lời được đăng. Cách tính này không loại trừ những lượt xem có thể đến từ các yếu tố khác, như độ phổ biến của bài đăng gốc hay các bình luận khác. Vì thế, các con số về tác động bị thổi phồng rất nhiều, cho thấy nhóm điều hành hoặc không biết cách tính hiệu quả hơn, hoặc cố ý không dùng.

Tác động

Thực tế, bằng chứng thu thập từ quan sát nguồn mở cho thấy hai mảng hoạt động chính của chiến dịch có mức tác động tiềm tàng rất khác nhau.

Các câu trả lời trên mạng xã hội mà chúng tôi xác định được thường có ít lượt thích, lượt xem và bình luận (chỉ ở mức một hoặc hai chữ số). Như đã nêu, các câu trả lời này thường chỉ chiếm một phần nhỏ tổng số bình luận của bài đăng tương ứng. Dựa trên Thang đo mức độ lan tỏa⁠(mở trong cửa sổ mới), xếp hạng chiến dịch gây ảnh hưởng từ 1 (thấp nhất) đến 6 (cao nhất), chúng tôi đánh giá mảng hoạt động này ở Cấp 2: có bình luận trên nhiều nền tảng nhưng ít dấu hiệu lan tỏa ra ngoài hoặc lấn át các phản hồi khác.

Ngược lại, các nhân vật nhà báo đã đưa được bài lên nhiều cơ quan báo chí, trong đó có những nơi sở hữu lượng người theo dõi đáng kể. Ví dụ, tính đến tháng 8/2026, một cơ quan báo chí trực tuyến đăng bài của chiến dịch có gần 2 triệu người theo dõi trên Facebook, gần 355.000 trên X và hơn 544.000 trên Instagram. Chúng tôi đánh giá mảng hoạt động này ở Cấp 4, vì nội dung liên tục lan sang một số cơ quan truyền thông.