Bỏ qua nội dung chính
OpenAI

21 tháng 9, 2026

Vấn đề toàn cầu

Xây dựng tiêu chuẩn cho giai đoạn tiếp theo của AI

Đang tải…

Sứ mệnh của chúng tôi là bảo đảm trí tuệ nhân tạo tổng hợp mang lại lợi ích cho toàn thể nhân loại. Như Sam Altman đã trình bày gần đây cùng Jakub Pachocki, chúng tôi ưu tiên công việc hướng tới sứ mệnh này theo ba mục tiêu chính:

  1. Định hướng giai đoạn phát triển tiếp theo của AI bằng cách xây dựng một nhà nghiên cứu AI tự động, cùng hệ thống đó liên tục giải quyết bài toán căn chỉnh và tìm cách để con người tiếp tục tham gia vào vòng lặp tự cải thiện.

  2. Đưa những lợi ích từ tiến bộ khoa học và tăng trưởng kinh tế mà các cỗ máy có trí thông minh cao tạo ra đến với mọi người.

  3. Trao quyền cho mỗi người bằng một AGI cá nhân.

AI đang đẩy nhanh hoạt động nghiên cứu và kỹ thuật của chính chúng tôi, đồng thời nghiên cứu có AI hỗ trợ đã tạo ra những tiến bộ trong toán học, bao gồm cả Bài toán Thiên niên kỷ Navier–Stokes. Tiến bộ này mang lại triển vọng lớn cho hai mục tiêu còn lại, có thể dẫn tới những khám phá quan trọng trong y học, dịch vụ chăm sóc sức khỏe dễ tiếp cận rộng rãi và khả năng tự chủ kinh tế cho các doanh nghiệp nhỏ và doanh nhân độc lập trên toàn thế giới.

AI đang tiến bộ tại nhiều công ty và quốc gia, và những bước tiến trong toàn lĩnh vực đang làm thay đổi cơ hội cũng như thách thức mà tất cả mọi người phải đối mặt. Bên cạnh những lợi ích khác, AI có năng lực và được căn chỉnh sẽ đóng vai trò quan trọng trong cách chúng ta vượt qua giai đoạn chuyển đổi này—bằng việc củng cố hệ thống phòng vệ, thúc đẩy nghiên cứu căn chỉnh và giúp mọi người hiểu cũng như định hướng các giai đoạn phát triển tiếp theo của AI.

Để vượt qua giai đoạn chuyển đổi này một cách an toàn, nghiên cứu căn chỉnh phải theo kịp các năng lực đó, qua đó bảo đảm những hệ thống do chúng tôi và các bên khác xây dựng vẫn phù hợp với các giá trị của con người và nằm dưới sự kiểm soát của con người. Điều này ngày càng quan trọng khi các hệ thống AI trở nên mạnh mẽ và tự chủ hơn, kể cả khi chúng đảm nhận ngày càng nhiều công việc nghiên cứu và phát triển AI. Để AI tiếp tục phát triển một cách an toàn và có lợi, chúng ta cần cả những tiến bộ trong nghiên cứu căn chỉnh lẫn các tiêu chuẩn chung nhằm định hướng hoạt động phát triển giữa các phòng thí nghiệm và quốc gia.

RSI

Nghiên cứu AI tự động có thể diễn ra với nhiều mức độ giám sát khác nhau của con người. Khi các hệ thống AI đảm nhận nhiều hơn công việc phát triển những thế hệ AI kế tiếp, chúng có thể ngày càng thúc đẩy quá trình tự cải thiện đệ quy (RSI), ngay cả khi con người vẫn tham gia. Khi quá trình này được tự động hóa nhiều hơn, tốc độ tiến bộ của AI có thể tăng nhanh chóng.

Chúng tôi tin rằng nghiên cứu AI tự động sẽ tạo ra các mô hình trực tiếp cải thiện cuộc sống của con người. Nghiên cứu này có thể giảm chi phí của trí thông minh tiên tiến để mọi người trên toàn thế giới đều được hưởng lợi. Nghiên cứu tự động cũng có thể giúp chúng tôi cải thiện đáng kể khả năng căn chỉnh và xây dựng biện pháp phòng vệ trước AI ngày càng mạnh—một nhà nghiên cứu AI tự động cũng có thể là nhà nghiên cứu về an toàn AI tự động. Các hệ thống mạnh hơn và được căn chỉnh có thể giúp bảo vệ cơ sở hạ tầng trọng yếu, chống lại các tác nhân AI nguy hiểm và phát triển những biện pháp bảo vệ mới.

RSI hoàn toàn tự chủ hiện chưa diễn ra, và chúng ta không nên theo đuổi điều đó trừ khi và cho đến khi có thể thực hiện một cách an toàn. Việc có nên tiếp tục và tiếp tục như thế nào phải phụ thuộc vào khả năng duy trì quyền kiểm soát của con người, cũng như các lựa chọn dân chủ dựa trên đầy đủ thông tin(mở trong cửa sổ mới) về lợi ích và rủi ro. Nếu được thực hiện mà không có sự thận trọng và quan tâm đúng mức, RSI có thể khiến con người mất quyền kiểm soát thực tế đối với quá trình phát triển AI và không thể giám sát những quy trình nghiên cứu mà họ không còn hiểu rõ. Từ đó, AI có thể trở nên nguy hiểm hơn, kém căn chỉnh hơn và nhìn chung là mối đe dọa đối với con người. Sự cố Hugging Face mà chúng tôi đã công bố, dù không trực tiếp bắt nguồn từ RSI, cho thấy trước những dạng rủi ro có thể trở nên nghiêm trọng hơn nhiều nếu thiếu các biện pháp bảo vệ và căn chỉnh vững chắc.

Tiêu chuẩn quốc tế

Các tiêu chuẩn quốc tế về thực hành an toàn và bảo mật trong quá trình phát triển AI tiên phong có thể quan trọng đối với việc điều tiết nhịp độ ở tuyến đầu không kém gì bản thân nghiên cứu căn chỉnh. Các tiêu chuẩn có thể tạo ra định nghĩa chung về bằng chứng chất lượng cao và những ngưỡng cơ sở được thống nhất cho mức độ chặt chẽ của các biện pháp bảo vệ kỹ thuật. Nói ngắn gọn, các tiêu chuẩn giúp chúng ta trả lời câu hỏi: “Thế nào là giảm thiểu hiệu quả rủi ro AI mang tính thảm họa?”

Các thể chế dân chủ hiện có như Trung tâm Tiêu chuẩn và Đổi mới AI (CAISI), luật tiểu bang và khuôn khổ liên bang về AI đều có thể hỗ trợ việc này, cùng với những hình thức hợp tác công–tư mới(mở trong cửa sổ mới). Tuy nhiên, hoạt động phát triển và triển khai AI đang diễn ra tại nhiều quốc gia, việc ứng dụng đang lan rộng trên toàn cầu, và tác động của AI có khả năng sẽ đến với mọi người theo cách này hay cách khác, vào một thời điểm nào đó.

Do đó, cần có những nỗ lực quốc tế nhằm xây dựng tiêu chuẩn để giải quyết một số thách thức chính:

  • Phân mảnh—Các phương pháp đánh giá, yêu cầu báo cáo và định nghĩa sự cố giữa các quốc gia có thể xung đột, khiến việc so sánh bằng chứng, tìm hiểu những năng lực mới xuất hiện và ứng phó với rủi ro xuyên biên giới trở nên khó khăn hơn.

  • Hành động tập thể—Việc mỗi quốc gia hành động độc lập có thể tạo ra những kết quả mà không quốc gia nào mong muốn. RSI có khả năng đẩy nhanh chính hoạt động nghiên cứu AI, có thể vượt quá năng lực chung của chúng ta trong việc nắm bắt tiến bộ, đánh giá rủi ro và duy trì sự giám sát có ý nghĩa của con người.

  • Năng lực không đồng đều—Hoạt động phát triển tiên phong và chuyên môn liên quan không được phân bổ đồng đều trên toàn thế giới. Điều này làm trầm trọng thêm cả hai vấn đề nêu trên.

Những thách thức này áp dụng cho cả mô hình mở lẫn mô hình đóng.

Cần nói rõ rằng mọi phòng thí nghiệm AI theo đuổi nghiên cứu AI tự động hoặc các năng lực tiên tiến khác đều phải chịu trách nhiệm thực hiện một cách an toàn, phù hợp với các nguyên tắc cơ bản về tự chịu trách nhiệm và luật pháp hiện hành. Lập luận của chúng tôi về các tiêu chuẩn bắt nguồn từ mục tiêu tránh tập trung quyền lực và tạo ra kết quả thực tiễn tốt hơn. Các tiêu chuẩn tạo điều kiện để nhiều bên liên quan bên ngoài các phòng thí nghiệm được góp tiếng nói vào cách công nghệ này phát triển, đồng thời cung cấp một bộ nguyên tắc minh bạch có thể tin cậy bất kể cách làm cụ thể của từng phòng thí nghiệm. Chúng ta cũng có khả năng đạt kết quả tốt hơn nếu các bên hợp tác để giải quyết những thách thức nêu trên.

Vì vậy, chúng tôi tin rằng Hoa Kỳ nên dẫn dắt nỗ lực hợp tác với các quốc gia trên thế giới để xây dựng những tiêu chuẩn kỹ thuật toàn cầu cho AI tiên phong, bao gồm cả RSI.

Dù chúng tôi kỳ vọng khái niệm này sẽ thay đổi đáng kể theo thời gian, hai khía cạnh sau vẫn sẽ đóng vai trò thiết yếu.

(1) Cơ chế thúc đẩy các tiêu chuẩn quốc gia và quốc tế bổ trợ lẫn nhau cho AI tiên phong

Một cách để thực hiện điều này là tận dụng mạng lưới các viện an toàn AI đang hình thành—chẳng hạn những viện đã được thành lập tại Úc, Canada, Đức, Pháp, Kenya, Nhật Bản, Hàn Quốc, Singapore, Ấn Độ và Vương quốc Anh—nhằm thúc đẩy việc thiết lập tiêu chuẩn thông qua CAISI và các tổ chức ngành cấp quốc gia, với trọng tâm cụ thể là: (1) các mô hình và nhà phát triển AI tiên phong, được đánh giá bằng các chuẩn đo năng lực; và (2) quản lý lợi ích–rủi ro đối với nghiên cứu AI tự động, bao gồm RSI. Hoa Kỳ có thể phát huy việc CAISI thành lập Mạng lưới Quốc tế về Đo lường, Đánh giá và Khoa học AI Tiên tiến(mở trong cửa sổ mới) vào năm 2024, qua đó tập hợp các tổ chức công để hợp tác về đo lường, đánh giá và khoa học AI.

Các tiêu chuẩn được xây dựng từ nỗ lực này sẽ tạo ra nền tảng kỹ thuật chung cho việc đo lường và đánh giá năng lực, đánh giá rủi ro và xác định mức độ đầy đủ của các biện pháp bảo vệ. Những tiêu chuẩn kỹ thuật này sẽ không phải là giấy phép, quy trình đánh giá bắt buộc trước khi phát hành hay yêu cầu phê duyệt đối với các mô hình AI. Chính phủ mỗi quốc gia sẽ quyết định có đưa những tiêu chuẩn này vào hệ thống pháp luật của mình hay không và đưa vào theo cách nào.

Công việc này cũng nên hỗ trợ một hệ sinh thái AI cạnh tranh bằng cách tham vấn các nhà phát triển mô hình mở và mô hình đóng, các chuyên gia kỹ thuật độc lập và giới học thuật. Các tiêu chuẩn chung nên được xây dựng minh bạch và thiết kế sao cho không tạo lợi thế cho bất kỳ công ty, quốc gia hay mô hình kinh doanh cụ thể nào, kể cả bằng cách khiến những bên mới gia nhập hoặc nhà phát triển mô hình trọng số mở khó cạnh tranh hơn.

Như chúng tôi đã đề xuất(mở trong cửa sổ mới), cách tiếp cận này có thể rút kinh nghiệm từ những lĩnh vực như hàng không và ổn định tài chính, nơi các quốc gia đã xây dựng tiêu chuẩn kỹ thuật chung cùng các kênh hợp tác đáng tin cậy mà không phải từ bỏ thẩm quyền quốc gia. Nỗ lực này cũng nên phối hợp chặt chẽ với các tổ chức tiêu chuẩn lâu đời và mới hơn như ISO(mở trong cửa sổ mới), Diễn đàn Mô hình Tiên phong(mở trong cửa sổ mới), Quỹ AI Tác nhân(mở trong cửa sổ mới)Liên minh AI Mở và An toàn(mở trong cửa sổ mới), cũng như các tổ chức chú trọng triển khai như Quỹ Appia, đơn vị đang xây dựng các đặc tả thực tiễn nhằm kết nối tiêu chuẩn quốc tế với hoạt động đánh giá AI trong thực tế.

(2) Các phép đo chung và quy trình báo cáo sự cố để cải thiện hành động tập thể

Các tiêu chuẩn AI quốc tế sẽ đặc biệt quan trọng trong việc quản lý mức độ tự chủ ngày càng tăng trong nghiên cứu AI và quá trình tự cải thiện đệ quy. Cụ thể, các tiêu chuẩn này có thể bao gồm:

  • Đánh giá tiến bộ AI liên quan đến RSI và quy mô nghiên cứu tự chủ đang diễn ra trong một công ty AI. Báo cáo gần đây của chúng tôi về việc đẩy nhanh nghiên cứu là một đóng góp ban đầu cho nỗ lực này.

  • Sự giám sát của con người đối với nghiên cứu AI tự động, bao gồm những loại quy trình nghiên cứu AI tự động nào cần kích hoạt hoạt động xem xét ngay lập tức của con người.

  • Phân loại, theo dõi, báo cáo và ứng phó với các sự cố liên quan đến căn chỉnh và nghiên cứu AI tự động, chẳng hạn các cấp độ nghiêm trọng và ngưỡng báo cáo sự cố chung. Khuôn khổ báo cáo sai lệch căn chỉnh của chúng tôi là một đóng góp ban đầu.

Ngoài các tiêu chuẩn này, chúng tôi cho rằng các đơn vị vận hành cơ sở hạ tầng trọng yếu và chính phủ trên toàn thế giới cần thiết lập những kênh liên lạc an toàn để chia sẻ các mối quan ngại về an ninh quốc gia, những lỗ hổng và mối đe dọa mới xuất hiện, cũng như các phương pháp thực hành tốt nhất trong lĩnh vực an toàn AI tiên phong đang phát triển nhanh chóng. Đối thoại giữa Hoa Kỳ và Trung Quốc trong các lĩnh vực này sẽ là một bước tiến tích cực, và các cuộc đàm phán sắp tới diễn ra vào thời điểm thích hợp.

Hoa Kỳ nên giữ vai trò dẫn dắt

Điều tiết nhịp độ phát triển AI không có nghĩa là duy trì một tốc độ định sẵn. Về mặt kỹ thuật, điều này có nghĩa là bảo đảm nghiên cứu căn chỉnh và việc triển khai các kết quả nghiên cứu đó luôn đi trước năng lực của AI. Về mặt xã hội, điều này có nghĩa là sử dụng các tiêu chuẩn, thể chế và hoạt động hợp tác để phát huy mạng lưới ngành, các mối quan hệ xã hội và lực lượng thị trường nhằm tạo ra kết quả đôi bên cùng có lợi. Lời kêu gọi gần đây về hành động tập thể trong phòng thủ mạng là một ví dụ cho khía cạnh thứ hai.

Hoa Kỳ có vị thế thuận lợi để dẫn dắt vì ngành AI của nước này đang ở tuyến đầu công nghệ, đồng thời vẫn giữ vị trí đặc biệt trong mạng lưới toàn cầu ở các lĩnh vực then chốt như tài chính, thương mại, quốc phòng, công nghệ và hệ thống thông tin. Việc dẫn dắt ngay từ bây giờ sẽ quyết định liệu Hoa Kỳ có định hình khuôn khổ AI toàn cầu hay chỉ đứng nhìn một hệ thống phân mảnh, bất bình đẳng và đầy xung đột hình thành xung quanh mình. Điều này cũng sẽ quyết định liệu AI tiên tiến có củng cố các mạng lưới hiện có của Hoa Kỳ và các đồng minh hay không; nếu không dẫn dắt, các mạng lưới ấy có thể suy yếu.

Cạnh tranh địa chính trị sẽ không chỉ xoay quanh việc ai dẫn đầu về kỹ thuật mà còn liên quan đến mức độ ứng dụng và phổ biến AI. Ngày càng có khả năng việc ứng dụng và phổ biến AI sẽ do bên thúc đẩy được sự hợp tác thực chất cùng các quy tắc hợp lý quyết định—những điều mà doanh nghiệp và xã hội ở khắp nơi đều mong muốn nếu đặt cược tương lai vào công nghệ này.

Nền quản trị quốc gia vững mạnh, được kết nối thông qua hợp tác quốc tế thiết thực, mở ra con đường hướng tới các biện pháp bảo vệ chặt chẽ hơn, đổi mới liên tục và khả năng tiếp cận rộng rãi lợi ích của AI.

Tác giả

OpenAI