Cửa sổ chính sách AI đang mở. Chúng ta cần hành động.
Tác giả: Chris Lehane, giám đốc Quan hệ Toàn cầu tại OpenAI
Chúng ta đã bước sang một chương mới về năng lực AI, và điều đó đòi hỏi một chương mới cho chính sách AI. Không công ty, ngành công nghiệp hay chính phủ nào có thể một mình giải quyết thách thức này. Chúng ta cần đối mặt với thời điểm này bằng cách ưu tiên hành động thiết thực hơn là theo đuổi chính sách hoàn hảo.
Đây là những gì chúng tôi đang làm:
Thúc đẩy các yêu cầu bắt buộc về an toàn AI ở cấp quốc gia. Chúng tôi muốn hợp tác với Quốc hội về quy định bắt buộc về an toàn AI ở cấp quốc gia, dựa trên năng lực.
Duy trì đà phát triển tại các bang. Cho đến khi Quốc hội hành động, chúng tôi sẽ tiếp tục ủng hộ luật cấp bang nhằm củng cố hệ sinh thái an toàn AI rộng hơn. Hôm nay, chúng tôi công bố ủng hộ bốn dự luật của California: SB 813 về hạ tầng tổng thể cho các đánh giá an toàn độc lập, AB 1405 về tiêu chuẩn dành cho kiểm toán viên AI, SB 1119 về bảo vệ người trẻ tuổi và AB 1864 về các biện pháp bảo vệ trước những mối đe dọa sinh học do AI hỗ trợ.
Thúc đẩy các tiêu chuẩn do ngành dẫn dắt. Chúng tôi sẽ hợp tác với các phòng thí nghiệm tiên phong khác để thúc đẩy các tiêu chuẩn AI tiên phong, xây dựng một nỗ lực tự nguyện ngay từ bây giờ, dù có hay không có sự hỗ trợ của chính phủ.
Xây dựng các tiêu chuẩn toàn cầu. Chúng tôi sẽ ủng hộ các phương pháp tiếp cận quốc tế tương thích để đo lường năng lực, quản lý rủi ro, duy trì sự kiểm soát của con người và xác định thời điểm cũng như cách thức cần làm chậm hoặc dừng phát triển, ngay cả khi điều đó đồng nghĩa với việc làm chậm sự tiến bộ về năng lực của mô hình.
Gần đây, Trưởng nhóm Khoa học của chúng tôi, Jakub Pachocki, đã viết rằng sự trỗi dậy nhanh chóng của trí tuệ máy, bao gồm tiềm năng tự cải tiến đệ quy, đòi hỏi “sự thận trọng tối đa”. OpenAI sẽ tiếp tục theo đuổi các giải pháp kỹ thuật cho việc căn chỉnh và giám sát, xây dựng hệ thống phòng thủ và làm chậm quá trình phát triển khi cần thiết. Nhưng công việc kỹ thuật trong từng phòng thí nghiệm riêng lẻ sẽ không đủ. Chúng ta cũng cần các tiêu chuẩn chung, kể cả về thời điểm nên làm chậm hoặc dừng phát triển.
Lợi ích và rủi ro đều vô cùng lớn. AI tiên tiến có thể đẩy nhanh quá trình phát triển thuốc mới, củng cố hạ tầng trọng yếu, mở rộng cơ hội kinh tế và giúp giải quyết những vấn đề khoa học mà nhiều thế hệ con người vẫn chưa thể giải quyết. Nhưng những năng lực khiến các mô hình hữu ích hơn cũng đi kèm rủi ro, và chúng sẽ không còn chỉ bị giới hạn trong một số ít phòng thí nghiệm tiên phong. Các mô hình được phát triển trên toàn thế giới, bao gồm các mô hình mở, sẽ ngày càng tiến gần đến các mô hình tiên phong hiện nay và được phổ biến rộng rãi.
Năng lực của Astra, những bằng chứng ban đầu về việc AI đẩy nhanh nghiên cứu và bài luận của Jakub đều cùng chỉ về một hướng: AI đang phát triển nhanh chóng và chính sách cần theo kịp.
Greg Brockman đã mô tả một "thời cơ cho lực lượng phòng thủ"(mở trong cửa sổ mới): khoảng thời gian hạn hẹp mà AI tiên phong có thể giúp lực lượng phòng thủ củng cố các hệ thống trọng yếu trước khi năng lực tấn công mạnh mẽ trở nên phổ biến. Các nhà hoạch định chính sách đang đối mặt với thời khắc tương tự: thời cơ đang khép lại để thiết lập những biện pháp bảo vệ bền vững trước khi năng lực AI vượt xa các thể chế chịu trách nhiệm quản trị chúng.
Khi năng lực gia tăng, niềm tin vào sự an toàn phải ngày càng quyết định nhịp độ tiến bộ của AI. An toàn không cản trở tiến bộ; chính an toàn giúp tiến bộ đi xa hơn và mang lại lợi ích cho nhiều người hơn.
Chúng tôi đã tăng cường các biện pháp bảo vệ về giám sát, căn chỉnh và bảo mật trong toàn bộ vòng đời phát triển mô hình, bao gồm cách ly chặt chẽ hơn cho khối lượng công việc nghiên cứu tiên phong, mở rộng giám sát hành vi của mô hình trong quá trình huấn luyện và đánh giá có sử dụng công cụ, cùng các quy tắc rõ ràng hơn về thời điểm cần chuyển các mối quan ngại lên cấp cao hơn. Đối với Astra, chúng tôi cũng triển khai giám sát toàn diện toàn bộ các quỹ đạo, bao gồm chuỗi tư duy, và một cổng đánh giá căn chỉnh bắt buộc trước khi triển khai nội bộ rộng rãi hơn.
Các biện pháp bảo vệ đó phải luôn đi trước năng lực. Khi việc tiếp tục tiến hành gây ra rủi ro an toàn không thể chấp nhận được, chúng tôi sẽ làm chậm hoặc dừng việc phát triển hay triển khai các hệ thống mà chúng tôi không thể bảo vệ một cách đầy đủ, như chúng tôi đã từng làm trước đây và theo yêu cầu của Khung chuẩn bị(mở trong cửa sổ mới) của chúng tôi.
Tự cải tiến đệ quy hoàn toàn tự chủ—trong đó các hệ thống AI tự mình thúc đẩy các thế hệ AI liên tiếp ngày càng mạnh hơn—hiện chưa diễn ra. Chúng ta không nên theo đuổi điều đó trừ khi và cho đến khi có thể thực hiện một cách an toàn.
Tuy nhiên, AI đã đẩy nhanh một số phần của hoạt động nghiên cứu dùng để phát triển và căn chỉnh thế hệ mô hình tiếp theo. Nghiên cứu mới nhất của chúng tôi cho thấy các tác nhân AI có thể thực hiện một số nhiệm vụ mà các nhà nghiên cứu lành nghề sẽ mất nhiều ngày để hoàn thành. Đây không phải là tự cải tiến đệ quy, nhưng là bằng chứng về hướng phát triển.
Sự tăng tốc đó cũng có thể và phải được hướng tới sự an toàn. Mục tiêu của chúng tôi là xây dựng một cách an toàn các nhà nghiên cứu AI tự động, hoạt động dưới sự giám sát của con người để thúc đẩy cả học sâu lẫn sự phù hợp—sử dụng mỗi thế hệ AI để giúp thế hệ tiếp theo an toàn hơn, phù hợp hơn và dễ kiểm soát hơn, chứ không chỉ mạnh hơn.
Các chính phủ nên xây dựng phương pháp chung để đo lường tiến triển này, duy trì quyền kiểm soát thực chất của con người và thiết lập các ngưỡng an toàn chung để xác định khi nào và cách thức cần làm chậm hoặc dừng phát triển. Nếu chúng ta không thể đáp ứng một số ngưỡng an toàn nhất định mà không làm chậm tốc độ tăng trưởng năng lực, chúng ta nên ưu tiên việc đáp ứng các ngưỡng an toàn nói trên. Công nghệ càng mạnh thì các biện pháp bảo vệ đi kèm càng phải vững chắc.
Triển vọng AI tăng tốc phát triển AI đòi hỏi nhiều hơn các cam kết tự nguyện. Hoa Kỳ cần quy định quốc gia bắt buộc dựa trên năng lực, có thể phát triển cùng với công nghệ.
Đề cương quản trị dân chủ đối với AI tiên phong của chúng tôi vạch ra con đường hướng tới một khuôn khổ liên bang bền vững: các yêu cầu chung về thử nghiệm và đánh giá độc lập, biện pháp bảo vệ an ninh mạng mạnh mẽ hơn, quy định rõ ràng về báo cáo sự cố, năng lực sẵn sàng quốc gia cao hơn và các thước đo chung để theo dõi tiến triển hướng tới khả năng tự cải tiến đệ quy.
Một số đề xuất nghiêm túc về an toàn AI tiên phong hiện đang thành hình tại Quốc hội. Chúng tôi sẽ tiếp tục tham gia trên tinh thần xây dựng và dự kiến ủng hộ các dự luật nâng cao đáng kể tiêu chuẩn an toàn. Khi lợi ích và rủi ro cao đến vậy, chúng ta không thể để sự cầu toàn trở thành kẻ thù của điều tốt. Quốc hội nên hành động trước khi kỳ họp kết thúc.
Một khuôn khổ quốc gia cần vững chắc nhưng được thiết kế có trọng tâm một cách cẩn trọng. Các yêu cầu về an toàn AI tiên phong chỉ nên áp dụng cho một số ít phòng thí nghiệm có nguồn lực dồi dào đang phát triển những hệ thống mạnh nhất—không áp dụng cho các công ty khởi nghiệp, nhà phát triển nhỏ hoặc nhà nghiên cứu hoạt động cách rất xa tuyến tiên phong. Nghĩa vụ cần tương xứng với năng lực và rủi ro.
Chính sách an toàn AI tiên phong cũng không nên trở thành chính sách về trọng số mở dưới một tên gọi khác. Các mô hình mở có thể là một phần của giải pháp, đặc biệt trong an ninh mạng và ở những nơi nhu cầu về chủ quyền, bảo mật hoặc nơi lưu trú dữ liệu phù hợp với triển khai cục bộ. Phần lớn cạnh tranh không phải ở tuyến tiên phong mà về chi phí, khả năng kiểm soát và độ trễ. Như chúng tôi đã khẳng định khi ký thư về Trọng số Mở và Vai trò Dẫn đầu AI của Hoa Kỳ(mở trong cửa sổ mới), nước Mỹ cần cả mô hình mở lẫn đóng. Một khuôn khổ liên bang nên giải quyết các năng lực và rủi ro tiên phong mà không làm suy yếu cạnh tranh, củng cố vị thế của các bên đương nhiệm hoặc đẩy đổi mới ra nước ngoài.
Một khuôn khổ công nghiêm túc phải làm giảm chứ không làm tăng mức độ tập trung quyền lực. Hiện nay, các phòng thí nghiệm tiên phong phần lớn tự đặt ra quy tắc để quản lý rủi ro biên. Các tiêu chuẩn chịu trách nhiệm giải trình dân chủ, cơ chế xác minh độc lập và tính minh bạch thực chất sẽ thay thế hệ thống quản trị tư nhân phân mảnh đó.
Điều này là thiết yếu để Hoa Kỳ giữ vai trò dẫn đầu. Hoa Kỳ không thể chiến thắng trong kỷ nguyên AI chỉ nhờ năng lực. Dẫn đầu về kỹ thuật sẽ chẳng có nhiều ý nghĩa nếu người dân, tổ chức và chính phủ không đủ tin tưởng để áp dụng công nghệ. Các biện pháp bảo vệ mạnh mẽ không phải là sự nhượng bộ gây bất lợi cho đổi mới. Chúng là một phần của hạ tầng cần thiết để AI được áp dụng rộng rãi—và để Hoa Kỳ duy trì vai trò dẫn đầu lâu dài.
Chúng ta rất cần các tiêu chuẩn quốc gia về AI và bất kỳ ai làm việc trong lĩnh vực tiên phong đều có thể thấy rõ tính cấp bách. Cho đến khi Quốc hội hành động, các bang nên tiếp tục hành động để lấp đầy khoảng trống và nâng cao tiêu chuẩn.
OpenAI đã ủng hộ SB 53 của California, Đạo luật RAISE của New York, SB 315 của Illinois, cũng như các cuộc kiểm toán độc lập trong dự luật an toàn AI tiên phong đang được Massachusetts xem xét. Chúng tôi khuyến khích các tiểu bang hội tụ quanh những biện pháp bảo vệ chung này. Khi làm vậy, họ có thể tạo ra một chuẩn cơ sở quốc gia trên thực tế mà Quốc hội cuối cùng có thể luật hóa—một cách tiếp cận chúng tôi gọi là chủ nghĩa liên bang ngược. Nhưng hài hòa hóa không thể đồng nghĩa với việc đóng băng các yêu cầu trong khi năng lực và rủi ro vẫn tiếp tục gia tăng.
Hôm nay, chúng tôi chính thức ủng hộ thêm bốn dự luật của California đã được cơ quan lập pháp thông qua và đang được trình lên Thống đốc Newsom. Khi kết hợp, các dự luật này giải quyết những phần bổ trợ cho nhau trong hệ sinh thái an toàn AI.
SB 813(mở trong cửa sổ mới) sẽ thiết lập quy trình chỉ định các tổ chức độc lập, đủ năng lực để đánh giá rủi ro AI. Như đã nêu trong (mở trong cửa sổ mới)đề cương an toàn AI tiên phong(mở trong cửa sổ mới) của chúng tôi, chúng tôi mong muốn các đánh giá kỹ thuật độc lập được bắt buộc ở cấp liên bang, nơi các nhà hoạch định chính sách có thể thiết lập các tiêu chuẩn nhất quán về năng lực của đơn vị đánh giá, bảo mật và quyền tiếp cận thông tin có độ nhạy cảm cao. Tuy nhiên, khi chưa có hành động ở cấp liên bang, California có thể góp phần thiết lập các quy tắc cho một hệ thống đánh giá độc lập cấp quốc gia an toàn, có năng lực và mang lại kết quả an toàn tốt hơn.
AB 1405(mở trong cửa sổ mới), dự luật sẽ đặt ra các yêu cầu về đăng ký, tính độc lập, minh bạch và trách nhiệm giải trình đối với kiểm toán viên AI.
SB 1119(mở trong cửa sổ mới) sẽ yêu cầu xác minh độ tuổi, đánh giá rủi ro, kiểm toán độc lập, kiểm soát của cha mẹ và các biện pháp bảo vệ trẻ em cũng như thanh thiếu niên sử dụng chatbot đồng hành khỏi nội dung có hại. Gần đây, chúng tôi đã bày tỏ sự ủng hộ đối với dự luật này, vốn phát triển dựa trên các biện pháp bảo vệ thanh thiếu niên mà OpenAI đã thúc đẩy thông qua sản phẩm, các nguyên tắc chính sách toàn cầu và việc ủng hộ (mở trong cửa sổ mới)Đạo luật AI an toàn cho cha mẹ và trẻ em(mở trong cửa sổ mới), cũng như các biện pháp bảo vệ được tích hợp trong ChatGPT dành cho thanh thiếu niên—bao gồm thiết lập mặc định chặt chẽ hơn ở các lĩnh vực nhạy cảm, Giờ yên tĩnh, Giờ học và lời nhắc nghỉ giải lao.
AB 1864(mở trong cửa sổ mới) sẽ yêu cầu các nhà cung cấp dịch vụ tổng hợp gen và nhà sản xuất thiết bị tổng hợp để bàn tuân thủ tiêu chuẩn sàng lọc liên bang, qua đó củng cố một biện pháp bảo vệ vật lý quan trọng trước các mối đe dọa sinh học có AI hỗ trợ.
Trước đây, chúng tôi không ủng hộ một số dự luật này, nhưng hiện đang ủng hộ sau khi xem xét lại dựa trên bước nhảy vọt gần đây về năng lực mà chúng tôi đã chứng kiến.
Các dự luật này không thay thế cho quy định liên bang. Đây là những nỗ lực nghiêm túc có thể bảo vệ người dân ngay từ bây giờ, cho thấy các biện pháp bảo vệ khả thi sẽ như thế nào và giúp tạo động lực cho hành động ở cấp liên bang.
Chỉ luật pháp thôi sẽ không giúp AI tiên tiến trở nên an toàn. Chúng ta cũng cần các thực hành cụ thể bên trong các phòng thí nghiệm đang phát triển những hệ thống có năng lực cao nhất. Nơi cấp bách nhất để bắt đầu là hoạt động giám sát.
Điều này đặc biệt quan trọng đối với tình trạng không đồng bộ mục tiêu—khi một mô hình theo đuổi mục tiêu theo cách vi phạm ý định của con người hoặc các giới hạn đã thiết lập mà không cần có ý thức hay ác ý. Khi các mô hình tự chủ hơn, sử dụng công cụ mạnh hơn và hoạt động trong thời gian dài hơn, nhà phát triển nên được yêu cầu giám sát những hành vi không đồng bộ mục tiêu này và chứng minh rằng đã có biện pháp bảo vệ hiệu quả.
Giám sát phải gắn liền với các yêu cầu công bố rõ ràng. Như chúng tôi đã đề xuất tại California, các công ty nên được yêu cầu nhanh chóng gửi thông báo bằng văn bản cho các bên bị ảnh hưởng khi, trong quá trình phát triển hoặc đánh giá, mô hình của họ vượt qua trái phép các biện pháp kiểm soát bảo mật của tổ chức khác và truy cập, thay đổi hoặc phá hủy đáng kể các hệ thống được bảo vệ hoặc thông tin mật của tổ chức đó. Chúng tôi cũng ủng hộ các yêu cầu báo cáo ở cấp liên bang đối với các sự cố AI nghiêm trọng khác và đang nỗ lực xác định những sự cố nào nên thuộc phạm vi áp dụng cũng như các yêu cầu đó nên bao gồm những gì.
Như đã chia sẻ tuần trước, OpenAI đang xây dựng một khuôn khổ để báo cáo các sự cố sai lệch có hậu quả đáng kể và giám sát có hệ thống hoạt động của mô hình tiên phong, bao gồm cả việc sử dụng nội bộ. Dù khởi đầu là một nỗ lực do công ty dẫn dắt, chúng tôi hy vọng nỗ lực này có thể cung cấp thông tin cho các chính sách và yêu cầu báo cáo rộng hơn ở cấp liên bang.
Chúng tôi muốn hợp tác với các phòng thí nghiệm khác về các tiêu chuẩn do ngành dẫn dắt. Mọi tiêu chuẩn do ngành dẫn dắt sẽ bổ sung—chứ không thay thế—các biện pháp bảo vệ bắt buộc ở cấp liên bang và sự giám sát dân chủ. Nhưng chúng ta đã bước vào một giai đoạn khác về năng lực AI, và mọi phương án đều cần được xem xét—bao gồm việc cân nhắc những gì có thể được xây dựng trên cơ sở tự nguyện bên ngoài chính phủ như một bước đi trước mắt.
Bất kỳ tiêu chuẩn nào như vậy rốt cuộc cũng phải mở rộng vượt ra ngoài biên giới quốc gia. Các mô hình, nghiên cứu và chuyên môn kỹ thuật lưu chuyển trên toàn cầu; sai sót liên quan đến những hệ thống mạnh nhất có thể gây hậu quả vượt xa quốc gia nơi chúng được phát triển. Hoa Kỳ cần thiết lập các tiêu chuẩn đáng tin cậy trong nước nếu muốn dẫn dắt trên trường quốc tế—và chúng tôi ngày càng tin rằng các tiêu chuẩn quốc tế tương thích sẽ là cần thiết.
Cánh cửa chính sách AI hiện vẫn đang mở. Chúng tôi quyết tâm tận dụng cơ hội này.
Điều đó có nghĩa là hành động với tinh thần khẩn trương, khiêm tốn và sẵn sàng thích ứng. Điều đó có nghĩa là ủng hộ các đề xuất nghiêm túc giúp nâng cao đáng kể tiêu chuẩn an toàn, ngay cả khi chúng không hoàn toàn giống với những gì chúng tôi sẽ thiết kế. Và điều đó có nghĩa là củng cố khuôn khổ khi công nghệ phát triển.
Không bước đi đầu tiên nào hoàn hảo. Nhưng rủi ro lớn hơn lúc này là chờ quá lâu mới thực hiện bước đi đó.


