‘엉터리 문법’: 러시아 연계 텔레그램 댓글 활동
OpenAI는 AI로 우크라이나, 몰도바, 발트 3국 및 미국 정치에 관한 영어·러시아어 텔레그램 댓글을 생성한, 이전에 알려지지 않은 러시아발 작전과 연계된 계정을 차단했습니다. OpenAI는 이 작전을 ‘엉터리 문법’이라고 명명했습니다.
이 사례 연구는 OpenAI의 2024년 5월(새 창에서 열기) 보고서에 처음 게재되었습니다.
행위자
OpenAI는 모델을 이용해 댓글을 작성한 뒤 텔레그램에 게시하던, 이전에 알려지지 않은 계정 네트워크를 차단했습니다. OpenAI는 이 활동이 러시아 출신 인물들과 연계된 것으로 파악했습니다. 텔레그램에 집중하고, 문법이 틀린 영어를 반복해서 게시했으며, 독자층 확보에 어려움을 겪었다는 점을 고려해 OpenAI는 이 네트워크를 ‘엉터리 문법’이라고 명명했습니다.
활동 방식
이 네트워크는 러시아어와 영어 콘텐츠로 러시아, 우크라이나, 미국, 몰도바, 발트 3국의 이용자를 겨냥했습니다.
이 네트워크는 OpenAI 모델과 텔레그램 계정을 이용해 댓글 스팸 게시 체계를 구축했습니다. 먼저 운영자들은 텔레그램 게시를 자동화하도록 설계된 것으로 보이는 코드를 디버깅하는 데 OpenAI 모델을 이용했습니다. 그런 다음 특정 텔레그램 게시물에 달 러시아어와 영어 댓글을 생성했습니다. 마지막으로 텔레그램 계정을 최소 12개 사용해 해당 댓글을 게시한 것으로 보입니다.

이 네트워크가 생성한 텍스트와 일치하는 공개 텔레그램 댓글. 해당 계정은 이 네트워크의 결과물과 일치하는 댓글을 반복해서 게시했습니다.
운영자들은 OpenAI 모델을 이용해 미국의 정치적 양극단에 속한 여러 인구 집단을 가장한 가짜 인물들의 말투로 영어 댓글을 생성했습니다. 러시아어의 경우 가상 인물 설정보다는 주제 중심의 지시를 선호했습니다.
이 네트워크는 주로 소수의 텔레그램 채널 게시물에 댓글을 달았습니다. 가장 많이 언급된 채널은 친러시아 성향의 @Slavyangrad였으며, 영어 채널인 @police_frequency와 @SGTNewsNetwork가 그 뒤를 이었습니다. (마지막 채널은 보수 성향의 미국 퇴역 군인을 가장하지만, 11월 Meta의 보고(새 창에서 열기)에 따르면 실제 발원지는 이란입니다.) 2월 활동 표본을 분석한 결과, 이 네트워크가 이 세 채널에 답글을 생성하려 한 횟수는 그다음으로 많이 언급된 10개 채널을 합친 횟수의 두 배였습니다.
콘텐츠
이 캠페인은 몇 가지 정치적 주제에 초점을 맞춘 짧은 댓글을 생성했습니다. 영어와 러시아어 모두에서 텔레그램에 게시한 주요 주제는 우크라이나 전쟁, 몰도바와 발트 3국의 정치 상황, 미국 정치였습니다.
전형적인 러시아어 텔레그램 댓글은 우크라이나와 몰도바 대통령이 부패했고 대중의 지지를 받지 못하며, 서방의 ‘개입’에 자국민을 팔아넘겼다고 비난했습니다. 영어 텔레그램 댓글은 이민, 경제적 어려움, 당일 속보 등의 주제에 초점을 맞췄습니다. 이러한 댓글은 시사적 사건을 근거로 미국이 우크라이나를 지원해서는 안 된다고 주장하는 경우가 많았습니다.

이 네트워크가 생성한 텍스트와 일치하는 공개 텔레그램 댓글. 해당 계정은 OpenAI 모델로 생성한 콘텐츠와 일치하는 댓글을 반복해서 게시했습니다.
때로는 둘 이상의 가상 인물이 같은 게시물에 서로 상반된 관점의 댓글을 달았습니다. 양쪽 진영의 목소리를 모두 가장하는 이러한 ‘두 얼굴’ 방식은 과거 러시아 작전에서도 관찰된 바 있으며, 특정 독자층을 끌어들이거나 분열을 조장하려는 의도일 수 있습니다.

이 네트워크가 생성한 텍스트와 일치하는 공개 텔레그램 댓글. 해당 계정들은 OpenAI 모델로 생성한 콘텐츠와 일치하는 댓글을 반복해서 게시했습니다.
3월 22일 모스크바 테러 공격과 타지키스탄 국적자 4명의 구금 이후, 이 캠페인은 타지키스탄에 초점을 맞춘 새로운 텔레그램 계정군을 사용하기 시작했습니다. 이들이 게시한 댓글은 타지크인과 러시아인의 단결과 러시아 법률의 존중을 촉구했습니다.
영향 평가
댓글 스팸은 생성형 AI가 등장하기 전부터 영향 공작(IO)에 흔히 사용되던 수법입니다. ‘엉터리 문법’은 새로운 기법으로 댓글을 생성했지만, 배포 체계는 이용자의 반응을 끌어내는 데 어려움을 겪었습니다.
좋아요나 답글을 받은 댓글은 극소수였습니다. 이 네트워크의 댓글은 일반적으로 개별 게시물에 달린 답글 중 소수에 불과했습니다. 다른 견해를 묻어버리는 것이 목표였다면 이를 달성하지 못한 셈입니다.
이 네트워크는 때때로 OpenAI 모델을 이용해 다른 텔레그램 사용자와 주고받은 것으로 추정되는 비공개 메시지를 생성했지만, 생성된 텍스트를 보면 상대방은 암호화폐 사기범이었던 것으로 보입니다.
영향 공작의 파급력을 최저 1단계부터 최고 6단계까지 평가하는 확산 척도(새 창에서 열기)를 적용하면, 이 사례는 단일 플랫폼에서만 게시 활동이 이루어지고 네트워크 외부 인물에 의해 유의미하게 확산되었다는 증거가 없는 1등급으로 평가됩니다.