Bỏ qua nội dung chính
OpenAI

Ngăn chặn các hành vi sử dụng AI độc hại

Khám phá các nghiên cứu tình huống và báo cáo mới nhất của OpenAI về cách chúng tôi phát hiện và ngăn chặn các hành vi sử dụng AI độc hại.

Thẻ màu vàng có họa tiết lưới, với dòng chữ màu tím “Nhận diện lừa đảo cùng ChatGPT”.

Nhận diện lừa đảo cùng ChatGPT: Tham khảo ý kiến thứ hai khi có điều gì đó bất thường

Tìm hiểu thêm(mở trong cửa sổ mới)

Cách thức hoạt động của quy trình đánh giá thủ công

Các hệ thống tự động giúp phát hiện hành vi có khả năng vi phạm, còn đội ngũ đánh giá thủ công đóng vai trò thiết yếu trong việc xác định và ngăn chặn các hành vi sử dụng AI độc hại, bao gồm lừa đảo, hoạt động mạng độc hại, hoạt động gây ảnh hưởng bí mật và các hành vi gây hại hoặc bất hợp pháp khác.

Phát hiện

Xác định dấu hiệu của các nỗ lực lạm dụng trên nhiều sản phẩm, báo cáo và đầu mối điều tra.

Điều tra

Điều tra viên xem xét hoạt động, liên kết các vụ việc liên quan và đánh giá hành vi trong bối cảnh cụ thể.

Ngăn chặn

Chúng tôi xử lý các tài khoản và mạng lưới vi phạm điều khoản hoặc chính sách, đồng thời tăng cường khả năng phòng vệ trước những hành vi lạm dụng tương tự.

Công bố

Khi phù hợp, chúng tôi công bố những phát hiện có thể giúp ngành của mình và toàn xã hội nhận diện cũng như ứng phó hiệu quả hơn với các mối đe dọa này.

Nghiên cứu tình huống

Khám phá các nghiên cứu tình huống từ những cuộc điều tra của OpenAI về hành vi sử dụng AI độc hại. Mỗi vụ việc giải thích các đối tượng đã tìm cách làm gì, sử dụng AI ra sao và OpenAI đã ứng phó như thế nào.

Báo cáo