Chế độ Không lưu giữ dữ liệu mang đến cho khách hàng API đủ điều kiện một cam kết rõ ràng: OpenAI không lưu giữ câu lệnh hay phản hồi của mô hình sau khi xử lý xong yêu cầu. Nhân viên OpenAI không thể truy cập nội dung khách hàng để xem xét1, và dữ liệu của khách hàng doanh nghiệp không được dùng để huấn luyện các mô hình của chúng tôi, trừ khi khách hàng chủ động đồng ý.
Khi các mô hình đảm nhận những tác vụ dài và phức tạp hơn, một số rủi ro nghiêm trọng có thể chỉ xuất hiện qua nhiều lượt tương tác. Các hệ thống an toàn hiện có tương thích với ZDR đánh giá riêng từng lượt tương tác. Hôm nay, chúng tôi giới thiệu bản xem trước của quy trình Xử lý An toàn Riêng tư, được thiết kế để nhận diện các mẫu hình trong những lượt tương tác liên quan mà không cho nhân viên OpenAI quyền truy cập nội dung gốc.
Đối với các bản triển khai ZDR, nội dung khách hàng vẫn nằm trên hạ tầng do khách hàng kiểm soát. Chúng tôi cũng đang phát triển một phương án lưu nội dung trên hạ tầng OpenAI và mã hóa bằng khóa do khách hàng kiểm soát. Trong cả hai trường hợp, hệ thống tự động có thể nhận diện hành vi có khả năng lạm dụng và trả về các tín hiệu an toàn giới hạn mà không để nhân viên OpenAI tiếp cận câu lệnh hay phản hồi gốc.
Những rủi ro nghiêm trọng nhất về an toàn AI không phải lúc nào cũng biểu hiện trong một lượt tương tác. Thông thường, ý đồ có khả năng gây hại chỉ trở nên rõ ràng khi xem xét nhiều lượt tương tác cùng nhau. Rủi ro tương tự có thể phát sinh khi đối tượng xấu liên tục thăm dò các biện pháp bảo vệ, phối hợp qua nhiều tài khoản hoặc ngụy trang mối đe dọa thành hoạt động nghiên cứu thông thường. Rủi ro cũng có thể phát sinh trong quá trình thực hiện một tác vụ có tính tác nhân—chẳng hạn khi hệ thống đi chệch ý định của người dùng vì vẫn tiếp tục hành động sau khi được yêu cầu dừng lại.
Khi các hệ thống AI đảm nhận những tác vụ dài và phức tạp hơn, bối cảnh rộng hơn này ngày càng quan trọng để phân biệt hoạt động hợp pháp với hành vi lạm dụng, đồng thời bảo đảm các tác nhân AI không vượt quá phạm vi thẩm quyền được giao.
Một số bản triển khai mô hình tiên phong gần đây yêu cầu khách hàng cho phép nhà cung cấp AI lưu giữ nội dung nhạy cảm để giám sát an toàn. Với nhiều tổ chức, những yêu cầu như vậy mâu thuẫn với nghĩa vụ bảo mật hoặc cam kết dành cho những người mà họ phục vụ.
Quy trình Xử lý An toàn Riêng tư được thiết kế để chúng tôi có thể tiếp tục cung cấp chế độ ZDR.
Quy trình Xử lý An toàn Riêng tư phát triển dựa trên các biện pháp bảo vệ tự động đã được sử dụng trong ZDR và những hình thức triển khai khác. Các hệ thống an toàn hiện có tương thích với ZDR đánh giá riêng từng lượt tương tác. Quy trình Xử lý An toàn Riêng tư mở rộng các biện pháp bảo vệ đó trên những lượt tương tác liên quan, cho phép hệ thống tự động nhận diện mẫu hình mà nhân viên OpenAI không cần truy cập nội dung khách hàng được lưu giữ.
Quy trình Xử lý An toàn Riêng tư sử dụng nội dung khách hàng bất kể nội dung được lưu ở đâu—trên hạ tầng do khách hàng kiểm soát (bản triển khai ZDR) hay trong bộ nhớ do OpenAI cung cấp. Khi sử dụng bộ nhớ do OpenAI cung cấp, nội dung khách hàng được mã hóa bằng khóa do khách hàng kiểm soát. Nhân viên OpenAI không có bản sao các khóa đó nên không thể truy cập nội dung gốc.
Khi phát hiện rủi ro, OpenAI nhận được một tín hiệu có phạm vi giới hạn rõ ràng, cho biết loại hoạt động liên quan, tương tự các hệ thống an toàn hiện nay của chúng tôi. Tín hiệu đó có thể được dùng để xác định xem có cần thực thi biện pháp xử lý hay không. Nhân viên OpenAI không được truy cập nội dung khách hàng ngay cả khi nội dung đó bị gắn cờ.
Khách hàng có thể điều tra cảnh báo và quyết định xử lý bằng thông tin có trong hệ thống của chính họ. Nếu muốn khiếu nại, làm rõ hoạt động hợp pháp hoặc hỗ trợ điều tra hành vi lạm dụng đã được xác minh, họ có thể chọn chia sẻ thông tin liên quan với OpenAI.
Quy trình Xử lý An toàn Riêng tư hiện đang được thử nghiệm với những khách hàng đầu tiên. Chúng tôi chia sẻ bản xem trước này ngay từ bây giờ vì khách hàng đã nói rất rõ rằng họ cần khả năng dự đoán cách nội dung của mình sẽ được bảo vệ khi các hệ thống AI ngày càng mạnh mẽ.
Sứ mệnh của chúng tôi là bảo đảm trí tuệ nhân tạo tổng hợp mang lại lợi ích cho toàn nhân loại. Hợp tác với khách hàng và đối tác là yếu tố thiết yếu trong cách chúng tôi xây dựng các biện pháp bảo vệ hiệu quả. Như các nguyên tắc của chúng tôi đã nêu rõ, không phòng thí nghiệm AI nào có thể đơn độc giải quyết các rủi ro mới xuất hiện. Quy trình Xử lý An toàn Riêng tư phản ánh phương pháp đó và đang được định hình với sự tham gia của khách hàng thuộc nhiều ngành, khu vực và quy mô doanh nghiệp khác nhau.
Các tổ chức hợp tác với chúng tôi xử lý một số loại thông tin nhạy cảm nhất trong lĩnh vực của họ, bao gồm hồ sơ tài chính, dữ liệu sức khỏe, kế hoạch kinh doanh mật và nghiên cứu độc quyền. Bảo vệ những thông tin đó là điều thiết yếu để đáp ứng nghĩa vụ pháp lý, duy trì niềm tin của khách hàng và bảo toàn lợi thế cạnh tranh.
Ý kiến phản hồi của họ đang giúp chúng tôi xây dựng các biện pháp bảo vệ vững chắc hơn, đồng thời duy trì quyền kiểm soát thông tin của họ.
“Việc ứng dụng AI trong doanh nghiệp hoàn toàn phụ thuộc vào quyền kiểm soát dữ liệu của khách hàng, không sử dụng trực tiếp hay gián tiếp dữ liệu đó ngoài dịch vụ đã chọn. Cam kết không dùng dữ liệu để huấn luyện và chế độ ZDR của OpenAI giúp Glean tự tin phát triển cùng OpenAI. Khi các mô hình ngày càng mạnh mẽ, OpenAI cho thấy mức độ an toàn có thể tiến bộ mà không làm ảnh hưởng đến quyền riêng tư và quyền kiểm soát vốn duy trì niềm tin của doanh nghiệp.”
—Sunil Agrawal, Giám đốc An ninh Thông tin, Glean
Chúng tôi sẽ tiếp tục phối hợp với khách hàng về các chi tiết kỹ thuật và vận hành trong phương pháp của mình. Chúng tôi dự kiến bắt đầu triển khai quy trình Xử lý An toàn Riêng tư và công bố sách trắng kỹ thuật vào tháng 9. Chúng tôi sẽ cập nhật cho khách hàng ở mọi giai đoạn, chia sẻ sớm các thông tin mới, giải thích ý nghĩa của chúng đối với những cam kết hiện tại, đồng thời dành đủ thời gian và hỗ trợ cần thiết để khách hàng chủ động lập kế hoạch.
Tác giả
- 1
Giống như các nhà cung cấp mô hình tiên phong khác, OpenAI có nghĩa vụ pháp lý(mở trong cửa sổ mới) phải báo cáo nội dung có dấu hiệu là tài liệu xâm hại tình dục trẻ em (CSAM). Như hiện nay, các hình ảnh bị gắn cờ là có khả năng chứa CSAM sẽ tiếp tục được lưu giữ để xem xét thủ công và phục vụ việc báo cáo, kể cả trong các bản triển khai chế độ Không lưu giữ dữ liệu.


