
運用 ChatGPT 識破詐騙:感覺不對勁時,多一層把關
人工審查如何運作
自動化系統有助於偵測可能的違規行為,而人工審查員在識別並瓦解惡意使用 AI 的行為方面不可或缺,包括詐騙、惡意網路活動、祕密影響力行動,以及其他有害或非法行為。
偵測
從產品、通報及調查線索中識別企圖濫用的跡象。
調查
人工調查員會審查活動、串聯相關案例,並依據情境評估行為。
瓦解
我們會對違反服務條款或政策的帳號與網路採取行動,同時強化防禦,以防範類似濫用行為。
公開
在適當情況下,我們會公布調查結果,協助業界與社會大眾更有效地辨識並因應這些威脅。
案例研究
探索 OpenAI 對惡意使用 AI 行為的調查案例。每個案例都會說明行為者的企圖、使用 AI 的方式,以及 OpenAI 如何因應。





