Pereiti prie pagrindinio turinio
OpenAI

Kenkėjiško DI naudojimo užkardymas

Susipažinkite su naujausiomis „OpenAI“ atvejų analizėmis ir ataskaitomis apie tai, kaip aptinkame ir užkardome kenkėjišką DI naudojimą.

Geltona tinklelio rašto kortelė su violetiniu užrašu „Sukčiavimo atpažinimas su ChatGPT“.

Atpažinkite sukčiavimą su „ChatGPT“: papildoma nuomonė, kai kažkas atrodo įtartina

Sužinoti daugiau(atsidaro naujame lange)

Kaip vyksta žmonių atliekama peržiūra

Automatinės sistemos padeda aptikti galimus pažeidimus, o žmonės vertintojai atlieka svarbų vaidmenį nustatant ir užkardant piktnaudžiavimą DI, įskaitant apgaules, kenkėjišką kibernetinę veiklą, slaptas įtakos operacijas ir kitą žalingą ar neteisėtą elgesį.

Aptikti

Nustatome bandymų piktnaudžiauti požymius produktuose, pranešimuose ir tyrimų medžiagoje.

Tirti

Tyrėjai peržiūri veiklą, susieja susijusius atvejus ir įvertina elgesį atsižvelgdami į aplinkybes.

Užkardyti

Imamės veiksmų prieš paskyras ir tinklus, pažeidžiančius mūsų naudojimo sąlygas ar politiką, ir kartu stipriname apsaugą nuo panašaus piktnaudžiavimo.

Viešinti

Kai tinkama, skelbiame išvadas, kurios gali padėti mūsų sektoriui ir visai visuomenei geriau atpažinti šias grėsmes ir į jas reaguoti.

Atvejų analizės

Susipažinkite su „OpenAI“ tyrimų apie kenkėjiško DI naudojimo atvejų analizėmis. Kiekvienoje analizėje paaiškinama, ką veiklos vykdytojai bandė padaryti, kaip naudojo DI ir kaip reagavo „OpenAI“.

Ataskaitos