Kalo te përmbajtja kryesore
OpenAI

1 shkurt 2025

Siguria

Mashtrim me karrem romantik: rrjedha pune për «therjen e derrit» me ndihmën e IA-së

OpenAI bllokoi llogari që dukej se e kishin origjinën në Kamboxhia dhe përdornin IA-në për të përkthyer e gjeneruar biseda mashtruese romantike dhe investimesh.

Duke ngarkuar…

Ky rast studimor u publikua fillimisht në raportin e OpenAI të shkurtit 2025⁠(hapet në një dritare të re).

Aktori

Bllokuam një grup llogarish ChatGPT që përkthenin dhe gjeneronin komente të shkurtra në japonisht, kinezisht dhe anglisht. Kjo veprimtari duket se e kishte origjinën në Kamboxhia dhe përputhej me një mashtrim romantik dhe investimesh (i njohur ndryshe si «therja e derrit»). Meta identifikoi së fundmi veprimtari të lidhura⁠(hapet në një dritare të re) në platformën e saj, të cilat dukej se e kishin origjinën në një qendër mashtrimesh të sapokrijuar në Kamboxhia.

Sjellja

Ky rrjet përdori modelet tona për të përkthyer dhe gjeneruar komente të shkurtra. Gjuha kryesore e aktorëve duket se ka qenë kinezishtja. Përmbajtja e gjeneruar ishte në disa gjuhë, kryesisht në japonisht dhe kinezisht, por edhe në anglisht.

Aktorët i përdorën modelet tona për dy veprimtari kryesore. Së pari, gjeneronin komente që postoheshin publikisht në platforma të mediave sociale, përfshirë Facebook, X dhe Instagram. Çdo llogari në mediat sociale zakonisht përmbante një ose më shumë fotografi profili të një gruaje të re. Vlerësojmë se të paktën disa prej tyre ishin kopjuar nga modele ose influencuese të vërteta, në vend që të ishin gjeneruar nga IA-ja.

Shumica e komenteve të gjeneruara u postuan si përgjigje ndaj postimeve të personave realë në mediat sociale. Disa nga postimet të cilave operatorët iu përgjigjën ishin disa muaj ose vite të vjetra. Ky operacion zakonisht synonte burra, profilet publike të të cilëve linin të kuptohej se ishin mbi 40 vjeç dhe shpesh punonin në profesione mjekësore. Operacioni u përgjigjej shpesh postimeve për golfin, çka sugjeron një strategji të qëllimshme përzgjedhjeje të objektivave. Herë pas here, mashtruesit postonin për çështje politike ose ngjarje aktuale.

Koment në Facebook i gjeneruar për një mashtrim romantik dhe investimesh.

Koment në Facebook, i gjeneruar nga ky aktor duke përdorur modelet tona dhe i postuar si përgjigje ndaj një komenti për golfin nga një person që nuk dukej i lidhur me këtë operacion. Fotografia e profilit të llogarisë mashtruese është kopjuar nga një influencuese amerikane e modës dhe bukurisë. Postimi fillestar ishte mbi një muaj i vjetër kur llogaria mashtruese komentoi në të.

Koment në X i gjeneruar për një mashtrim romantik dhe investimesh.

Koment i gjeneruar nga modelet tona, i postuar nga një llogari e verifikuar në X si përgjigje ndaj një postimi nga një llogari që nuk dukej e lidhur me këtë mashtrim. Fotografia e profilit të llogarisë është kopjuar nga e njëjta influencuese amerikane e modës dhe bukurisë. Postimi fillestar ishte gati gjashtë muaj i vjetër.

Së dyti, dhe më shpesh, operatorët gjeneronin komente të shkurtra që ngjanin me pjesë të një bisede në internet. Zakonisht kjo përfshinte përkthimin e komenteve nga kinezishtja në një gjuhë të synuar (japonisht ose anglisht), ose nga gjuha e synuar përsëri në kinezisht. Kjo përputhet me përdorimin e modelit nga mashtruesit kryesisht për të përkthyer biseda në zhvillim.

Ndonjëherë, llogaritë i kërkonin modelit të gjeneronte një përgjigje me një ton të caktuar, për shembull si një grua e re flirtuese. Ndonjëherë jepeshin të dhëna të hollësishme biografike për ta orientuar modelin në përgjigjet e tij, përfshirë emrin, arsimimin, punën, vendndodhjen dhe pasionet e personazhit të rremë. Këto biografi zakonisht përfshinin hollësinë se personazhi i rremë merrej herë pas here me investime në internet.

Mashtruesit duket se kanë përdorur shumë mjete dhe platforma të ndryshme për të komunikuar me objektivat e tyre. Hetimi ynë zbuloi prova se ata përdornin mjete që përfshinin LINE, WhatsApp, X, Facebook, Instagram, një sërë shërbimesh të tjera mesazhesh, funksionin «Fshih emailin tim» të Apple⁠(hapet në një dritare të re), si dhe platforma kriptomonedhash dhe këmbimi valutor.

Përfundimet

Bazuar në këndvështrimin tonë të kufizuar mbi këtë veprimtari, mashtruesit duket se ndiqnin një rrjedhë pune të zakonshme për t'i kaluar objektivat nga kontakti fillestar te investimi mashtrues:

  1. Angazhimi publik: Mashtruesit komentonin në postimet e objektivit në mediat sociale. Këto komente shpesh përfundonin me një pyetje si: «Çfarë mendoni për [temën]?», me gjasë për të rritur mundësinë e ndërveprimit. Në disa raste të rralla, komentonin për politikën, por më shpesh flisnin për golfin.

  2. Mesazhe të mundshme të drejtpërdrejta: Më pas, mashtruesit gjeneronin komente të shkurtra në stil bashkëbisedues. Ndonëse nuk kemi pamje të plotë se si dhe ku u përdorën këto komente, ato përputheshin me një situatë ku mashtruesi dhe objektivi kishin filluar të shkëmbenin mesazhe të drejtpërdrejta.

  3. Mesazhe të sigurta: Shumë shpejt, shpesh brenda pak ditësh, mashtruesit gjeneronin mesazhe që sugjeronin kalimin në një aplikacion më të sigurt mesazhesh. Ndonjëherë këtë e justifikonin duke thënë se mashtruesi nuk u besonte mediave sociale; herë të tjera përdornin një justifikim praktik, si për shembull se do të shkonin diku ku nuk do të kishin qasje në mediat sociale.

  4. Angazhimi romantik: Mashtruesit shkruanin dhe përkthenin mesazhe gjithnjë e më të përzemërta dhe intime. Nëse objektivat kërkonin fotografi të «gruas» me të cilën po bisedonin, mashtruesit nxirrnin justifikime.

  5. Angazhimi financiar: Mashtruesit shkruanin dhe përkthenin mesazhe ku mburreshin se kishin fituar shuma të mëdha parash duke investuar në internet në valutë të huaj, kriptomonedha ose ar. Kjo shpesh paraqitej si rezultat i ndjekjes së këshillave të një të afërmi që punonte në financë. Mashtruesi e nxiste objektivin të fillonte të investonte në të njëjtën mënyrë dhe i ofronte udhëzime gjatë procesit.

  6. Mashtrimi: Mashtruesit shkruanin dhe përkthenin mesazhe për ta bindur viktimën të transferonte para në një aplikacion tregtimi dhe e nxitnin duke theksuar sa shumë fitim po nxirrte. Sa herë që viktima përpiqej të tërhiqte «fitimet», mashtruesi nxirrte një justifikim, si për shembull se duhej paguar një tarifë.

Ky model veprimtarie përputhet me raportimet publike⁠(hapet në një dritare të re) për mënyrën se si funksionojnë zakonisht mashtrime të tilla.

Ndikimi

Kjo veprimtari duket se ka përfshirë shumë përpjekje të dështuara dhe dështime. Disa nga bisedat që mashtruesit përpunuan përmes modeleve tona përfunduan kur objektivi e denoncoi veprimtarinë si mashtrim ose i kërkoi mashtruesit ta linte të qetë. Identifikuam gjithashtu postime të mashtruesve në mediat sociale që nuk patën asnjë ndërveprim.

Megjithatë, në disa biseda përmendeshin shuma prej mijëra dollarësh (ose vlera të barasvlershme në monedha të tjera) si përmasa e transaksioneve individuale. Për shkak të mënyrës se si këta operatorë i përdorën modelet tona, nuk kemi të dhëna nëse këto transaksione financiare u kryen, por referencat në biseda sugjerojnë se, të paktën në disa raste, mashtruesit arritën t'i mashtronin financiarisht objektivat e tyre.

Politikat e OpenAI ndalojnë rreptësisht përdorimin e përmbajtjeve të gjeneruara nga mjetet tona për mashtrime. Jemi të përkushtuar të bashkëpunojmë me organizata të tjera të industrisë dhe autoritetet për të kuptuar se si përdoret IA-ja në veprimtari keqdashëse dhe për të ndërprerë në mënyrë aktive mashtrimet që abuzojnë me shërbimet tona. Në përputhje me këtë angazhim, u kemi dhënë organizatave të tjera të industrisë dhe autoriteteve përkatëse informacion për rrjetet e mashtrimit që ndërpremë.