Bỏ qua nội dung chính
OpenAI

17 tháng 8, 2026

Bảo mật

Góc nhìn của người bảo vệ

Bởi Greg Brockman

Đang tải…

Sự cố OpenAI-Hugging Face(mở trong cửa sổ mới) là một thời khắc bước ngoặt đối với an ninh mạng vì nó cho thấy phần nào cách năng lực của một tác nhân đe dọa điển hình sẽ phát triển trong những tháng tới. Trong vài tuần qua, tôi đã trao đổi với nhiều tổ chức, và có một chủ đề rất rõ ràng: họ biết rằng mình cần nâng cấp một cách căn bản các biện pháp an ninh mạng của mình với tốc độ chưa từng có. Trong bài viết này, tôi sẽ chia sẻ những gì chúng tôi đang làm để bảo vệ OpenAI, các bước cụ thể mà những tổ chức khác có thể thực hiện ngay hôm nay, và lý do vì sao hiện tại là thời điểm cần hành động.

Tổng quan về thời điểm

Các mô hình AI được phát triển trên khắp thế giới ngày càng có khả năng tự động hóa một phần các cuộc tấn công mạng trong thực tế, khiến các lỗ hổng bảo mật tồn tại từ lâu—từ những lỗi nằm sâu trong phần mềm do con người viết cho đến các quyền truy cập bị bỏ quên—dễ bị phát hiện và khai thác hơn. Những năng lực AI đó cũng mang đến cho những người phòng thủ những cách mới để tìm ra và khắc phục các điểm yếu đó, nhưng họ cần hành động ngay bây giờ. Nếu các công ty hành động quyết liệt—bao gồm cả việc củng cố các nền tảng cốt lõi và trao cho đội ngũ của họ sức mạnh vượt trội nhờ AI—chúng ta có thể làm cho Internet an toàn hơn bao giờ hết.

Trong Sự cố OpenAI-Hugging Face, một tập thể tác nhân đã có thể tự động xâm nhập không chỉ vào hạ tầng nghiên cứu của OpenAI mà còn vào hạ tầng sản xuất của một công ty khác, xâu chuỗi các lỗ hổng từ những lỗ hổng bảo mật chưa từng được biết đến trước đó đến việc sử dụng thông tin xác thực của các tài khoản người dùng đã bị rò rỉ lên internet. Ngày càng rõ ràng rằng nợ kỹ thuật(mở trong cửa sổ mới) của mọi công ty đều che giấu những lỗ hổng nghiêm trọng, và những người phòng thủ cần tìm ra và khắc phục chúng trước khi kẻ tấn công làm điều đó.

Để tạo lợi thế cho đội ngũ phòng thủ so với các bên tấn công, đầu năm nay chúng tôi đã bắt đầu chỉ phát hành các năng lực an ninh mạng của mình cho những người phòng thủ đáng tin cậy. Kể từ đó, nhiều công ty đã phát hành các mô hình trọng số mở có năng lực mạng chỉ chậm hơn mức tiên phong vài tháng. Mô hình mới nhất trong số này dường như được lên kế hoạch phát hành(mở trong cửa sổ mới) vào cuối tháng 8, và có vẻ sẽ đẩy nhanh đáng kể bối cảnh mối đe dọa.

Mặc dù những kẻ tấn công được hỗ trợ bởi AI sẽ sớm có thể tìm ra các lỗ hổng tồn tại lâu nay trong nhiều hệ thống hiện có, AI cũng sẽ giúp những người phòng thủ dễ dàng hơn rất nhiều trong việc tìm ra, ưu tiên và khắc phục chính những lỗ hổng đó. Bảo mật vẫn là một trò mèo vờn chuột, nhưng AI có thể làm thay đổi các yếu tố kinh tế của cuộc chơi này(mở trong cửa sổ mới) theo những cách về cơ bản mang lại lợi thế cho bên phòng thủ. Ví dụ: chúng tôi đang bắt đầu huấn luyện các mô hình của mình một cách chuyên biệt để viết mã an toàn ở mức siêu phàm. Các mô hình của chúng tôi cũng cực kỳ xuất sắc trong chứng minh toán học, và điều này có thể được áp dụng để chính thức xác minh tính bảo mật của phần mềm theo cách vốn được chứng minh là nằm ngoài khả năng giải quyết của con người.

Một câu chuyện cá nhân

Sau sự cố của OpenAI-Hugging Face, tôi đã nhờ ChatGPT Công việc (sử dụng GPT‑5.6 Sol có sẵn công khai) đánh giá bảo mật của gregbrockman.com(mở trong cửa sổ mới). Đó là một trang web tĩnh đơn giản, được lưu trữ trên AWS và sử dụng Cloudflare làm lớp cửa ngõ phía trước, nên tôi nghĩ sẽ không có nhiều diện tấn công có thể phát sinh lỗ hổng.

Trong khoảng 15 phút, nó đã phát hiện ra 13 vấn đề, nhiều vấn đề trong số đó có lẽ tự chúng không thể bị khai thác—nhưng tôi có thể hình dung chúng được xâu chuỗi với các lỗ hổng khác để tạo ra tác động đáng kể. Tôi đã không cấu hình các bản ghi DNS của mình để ngăn kẻ tấn công giả mạo email từ tôi; trang web của tôi dùng một phiên bản jQuery không an toàn; Cloudflare đang chuyển tiếp các yêu cầu đến AWS qua HTTP không được mã hóa.

Sau đó, tôi yêu cầu ChatGPT Công việc khắc phục những sự cố này, và nó đã làm như vậy trong suốt một giờ. Nó đã mở bảng điều khiển Cloudflare trong trình duyệt của tôi, rồi tiếp tục nhấp vào nhiều nút để định cấu hình DNS, TLS và các cài đặt bảo mật nâng cao một cách chính xác; nó đã loại bỏ hoàn toàn jQuery khỏi trang web; nó đã chuyển tôi khỏi AWS và sang Cloudflare Pages; nó đã bắt đầu triển khai DMARC(mở trong cửa sổ mới) theo từng giai đoạn.

Và đây mới chỉ là trang web cá nhân của tôi. Đây là một ví dụ nhỏ về cách các mô hình hiện có của chúng tôi có thể hoạt động như một người bảo vệ an ninh mạng—tìm ra những vấn đề thuộc phần đuôi dài mà con người sẽ không có đủ thời gian hoặc chuyên môn để xử lý (nhiều cài đặt mà mô hình đã sửa là những thứ tôi chỉ biết một cách mơ hồ, nhưng sẽ không thể biết ngay cách cấu hình đúng), rồi khắc phục chúng bằng một kế hoạch triển khai được điều chỉnh phù hợp.

OpenAI đang làm gì để tự bảo vệ chính mình

Sự cố Hugging Face cho thấy chúng ta đã đánh giá thấp khả năng mạng trong thế giới thực của các mô hình AI của mình. Theo đó, chúng tôi đang tăng cường các yêu cầu an toàn của mình, qua đó càng làm gia tăng thêm tính cấp thiết đối với công tác nghiên cứu an toàn và bảo mật nội bộ hiện có của chúng tôi.

Tôi muốn chia sẻ đôi chút về cách tiếp cận của chúng tôi trong việc bảo vệ OpenAI trong thời điểm này, với hy vọng điều này sẽ hữu ích cho các tổ chức khác. Để bảo vệ OpenAI, chúng tôi đang đầu tư đáng kể vào cả các biện pháp kiểm soát nền tảng—thực hiện đúng những điều cơ bản—và tăng cường năng lực phòng vệ của mình thông qua Độ thông minh tiên phong. Có bốn trụ cột chính trong chiến lược này.

Trước tiên, chúng tôi đang sử dụng các mô hình của mình để giúp bảo mật mã nguồn của mình. Codex, bao gồm cả tiện ích bảo mật của chúng tôi, xác thực các thay đổi mã, xác định các lỗ hổng bảo mật và giúp nhà phát triển khắc phục sự cố trước khi triển khai. Việc chỉ đơn giản tạo ra nhiều phát hiện bảo mật hơn cần con người xác thực không phải là mục tiêu; mục tiêu là phát hiện các lỗ hổng thực sự trước khi chúng được phát hành và rút ngắn con đường từ việc phát hiện một sự cố đến việc triển khai an toàn một bản sửa lỗi. Khi chúng tôi tiếp tục huấn luyện các mô hình của mình để tạo ra mã ngày càng an toàn hơn, mục tiêu của chúng tôi là loại bỏ một số loại lỗ hổng phần mềm đối với mã mới được viết.

Thứ hai, chúng tôi đang đưa các mô hình của mình vào vận hành để liên tục bảo vệ hạ tầng của mình. Ngày nay, gần như tất cả cảnh báo bảo mật ban đầu của chúng tôi đều được độ thông minh sàng lọc và phân loại ưu tiên trước khi con người được đưa vào quy trình. Điều này giúp giảm bớt công việc nặng nhọc cho các bên phòng vệ, cải thiện thời gian phản hồi và cho phép con người dành thời gian vào những nơi mà kỹ năng của họ được tận dụng nhiều nhất—trong sự phân định, phán đoán và chuyên môn ứng dụng. Chúng tôi ngày càng liên kết các phát hiện này với những phản hồi tự động có giới hạn, đồng thời vẫn để con người chịu trách nhiệm đối với các quyết định có tác động cao nhất. Mục tiêu là đảm bảo chúng ta có thể phát hiện và ứng phó với các sự cố bảo mật với tốc độ máy.

Thứ ba, chúng tôi đang sử dụng độ thông minh tiên phong để liên tục liệt kê, thăm dò và xác định các đường dẫn tấn công tiềm ẩn. Bằng cách xác định các lỗ hổng, cấu hình sai, danh tính được cấp quá nhiều đặc quyền hoặc các ranh giới tin cậy ngoài ý muốn, chúng tôi có thể nhanh chóng xác định và khắc phục các lỗ hổng này trước khi chúng có thể bị kẻ tấn công lợi dụng. Điều này cho phép chúng tôi liên tục đánh giá, giám sát và kiểm thử các bất biến bảo mật của mình—những thuộc tính bảo mật mà chúng tôi tin là đúng—trên các sản phẩm, cơ sở hạ tầng và hệ thống của mình.

Cuối cùng, chúng tôi đang đầu tư mạnh mẽ vào các yếu tố nền tảng ở quy mô lớn. Chúng tôi tiếp tục đầu tư vào kiến trúc và các biện pháp kiểm soát bảo mật, áp dụng các chiến lược như phòng thủ theo chiều sâu và đặc quyền tối thiểu, đồng thời đang thiết kế các hệ thống đòi hỏi nhiều biện pháp kiểm soát độc lập phải cùng lúc thất bại thì mới xảy ra điều gì đó thảm khốc. Các biện pháp kiểm soát bảo mật truyền thống như cách ly mạng, tăng cường bảo mật cho workload, giám sát, cũng như vá lỗi và triển khai an toàn sẽ trở nên quan trọng hơn bao giờ hết trong tương lai AI.

Đội ngũ phòng thủ nên làm gì ngay bây giờ

Thời gian là yếu tố cốt yếu, và những người phòng thủ sẽ cần thực hiện các bước dưới đây với tốc độ turbo. Dưới đây, tôi sẽ đề cập đến công nghệ của OpenAI, nhưng cũng có rất nhiều đối thủ cạnh tranh trong hệ sinh thái cần được đánh giá. Điều quan trọng không hẳn là công cụ cụ thể nào, mà là đưa AI đủ năng lực vào tay đội ngũ phòng thủ của bạn ngay từ bây giờ.

  • Đạt được cam kết và sự đồng thuận của tổ chức. Chúng ta đang chứng kiến sự thay đổi nhanh chóng về rủi ro bảo mật—hãy đảm bảo các bộ phận bảo mật và kỹ thuật của bạn có sự hỗ trợ, quan hệ hợp tác và nguồn lực cần thiết để nhanh chóng giải quyết các rủi ro này. Thực hiện các bài tập diễn tập tình huống với các nhóm của bạn để mô phỏng cách những cuộc tấn công này có thể biểu hiện trong tổ chức của bạn và cách bạn sẽ ứng phó.
  • Trao cho đội ngũ bảo mật của bạn một tác nhân. Bắt đầu sử dụng Codex, plugin Codex Security(mở trong cửa sổ mới), hoặc một công cụ bảo mật và lập trình tác nhân có năng lực khác. Cấp cho nó quyền truy cập đã được phê duyệt vào các cơ sở mã, cấu hình hạ tầng và tài liệu kỹ thuật mà đội ngũ bảo mật của bạn cần đánh giá. Đừng đợi đến khi triển khai trên toàn công ty mới bắt đầu với các hệ thống ưu tiên cao nhất của bạn.
  • Trang bị chuyên môn về bảo mật cho tác nhân đó. Bắt đầu từ các kỹ năng(mở trong cửa sổ mới) được cộng đồng hỗ trợ, bao gồm các quy trình làm việc cho phân tích tĩnh, rà soát mã tập trung vào bảo mật, phân tích biến thể lỗ hổng, rủi ro chuỗi cung ứng phần mềm và các quy trình bảo mật khác. Sau đó xây dựng các kỹ năng của riêng bạn xoay quanh kiến trúc, tiêu chuẩn bảo mật, mô hình mối đe dọa và sổ tay ứng phó của tổ chức bạn.
  • Chạy đánh giá bảo mật ngay lập tức đối với các hệ thống của riêng bạn. Ưu tiên trước các đánh giá đối với các dịch vụ hướng ra internet, các luồng xác thực, hạ tầng dưới dạng mã, các quy trình triển khai và các hệ thống xử lý thông tin nhạy cảm. Mở rộng việc quét của bạn khi nhóm của bạn xây dựng sự tự tin.
  • Xử lý lượng lỗ hổng tồn đọng hiện có của bạn. Cung cấp cho tác nhân của bạn các phát hiện từ trình quét mã, cảnh báo phụ thuộc, phiếu bảo mật, báo cáo săn lỗi nhận thưởng và các đánh giá trước đó. Yêu cầu tác nhân phân loại ưu tiên các phát hiện đó, phân biệt các vấn đề có thể khai thác với các vấn đề không cần thiết, xác định các lỗ hổng liên quan ở nơi khác trong cơ sở mã và đề xuất nội dung cần khắc phục trước tiên.
  • Đưa đánh giá bảo mật trực tiếp vào quy trình phát triển của bạn. Sử dụng các tác nhân để đánh giá các thay đổi mã trước khi chúng được hợp nhất và chạy các kiểm tra bảo mật trong CI. Tìm lỗi xác thực, các trường hợp vượt qua kiểm soát truy cập, thông tin xác thực bị lộ, các phần phụ thuộc không an toàn, các thiết lập mặc định không an toàn, các thay đổi làm mở rộng quyền truy cập vào hệ thống sản xuất và các lỗ hổng khác.
  • Hãy để tác nhân hỗ trợ khắc phục những gì nó tìm thấy. Đối với các vấn đề đã được xác thực, hãy yêu cầu tác nhân tạo và xác minh một bản vá tập trung, viết một bài kiểm thử hồi quy và xác nhận rằng lỗ hổng không còn tái diễn nữa. Vẫn duy trì khâu đánh giá của con người đối với những thay đổi có hệ quả lớn, nhưng loại bỏ sự chậm trễ không cần thiết giữa việc xác định một vấn đề thực sự và đưa ra một bản sửa lỗi an toàn cho kỹ sư.
  • Từng bước tự động hóa phân loại phát hiện. Đừng bắt đầu bằng việc cố gắng xây dựng một trung tâm vận hành bảo mật tự vận hành. Hãy bắt đầu bằng cách chạy một lần quét bảo mật chỉ đọc trên một kho lưu trữ hoặc để một tác nhân xem xét các cảnh báo đã được xử lý trước đó bằng quyền truy cập chỉ đọc vào các nhật ký hiện có của bạn. Hãy để nó tóm tắt bằng chứng và đề xuất hướng xử lý, trong khi con người đưa ra mọi quyết định. Khi độ tin cậy tăng lên, hãy chuyển sang quét pull request ở chế độ tư vấn, sau đó là phân loại cảnh báo trực tiếp, rồi đến tự động đóng các trường hợp dương tính giả được xác định rõ ràng.
  • Chuẩn bị sẵn năng lực điều tra pháp y có AI hỗ trợ trước khi bạn cần đến nó. Đăng ký Trusted Access for Cyber(mở trong cửa sổ mới) để nhóm của bạn được phê duyệt sử dụng GPT‑Daybreak‑Blue cho công việc phòng thủ được ủy quyền, bao gồm ứng phó sự cố, kỹ thuật phát hiện và phân tích phần mềm độc hại. Thực hành sử dụng năng lực này để phân tích nhật ký, dữ liệu đo từ xa và cảnh báo bảo mật.
  • Thử nghiệm, tổ chức các tuần lễ hackathon và cải tiến nhanh chóng. Chúng ta sẽ cần xây dựng đủ loại công cụ mới, thay đổi cách chúng ta làm việc và nâng cao năng lực cho mọi người để phù hợp với thế giới mà chúng ta đang chuyển tới. Khuyến khích đội ngũ nhân viên của bạn tiến hành các thử nghiệm, lên lịch một tuần hackathon để xây dựng các năng lực mới, đồng thời tập trung vào việc nhanh chóng lặp lại và cải tiến các vòng lặp nhằm tự động hóa những phần nhỏ của vấn đề. Tiến bộ nhanh theo từng bước nhỏ sẽ giúp hiệu quả phòng vệ được tích lũy và gia tăng theo thời gian, đồng thời bạn có thể mở rộng quyền tự chủ dần dần khi đội ngũ của mình xây dựng được sự tự tin.

Không một công ty nào có thể làm điều này một mình. Lời kêu gọi của chúng tôi là các phòng thí nghiệm AI, nhà cung cấp bảo mật, doanh nghiệp và bên duy trì hãy chia sẻ các phát hiện đã được xác thực, bản sửa lỗi và cẩm nang thực tiễn để phát hiện của một tổ chức có thể củng cố toàn bộ hệ sinh thái.

Cơ hội của lực lượng phòng vệ hiện đã mở ra. Trong những tháng tới, mọi tổ chức sẽ cần bắt đầu tự động hóa đáng kể chương trình bảo mật của mình để duy trì an toàn, và cộng đồng an ninh mạng phải khẩn trương đứng ra xác định các công cụ, phương pháp thực hành và sổ tay quy trình nhằm tăng cường năng lực của bên phòng thủ nhanh hơn năng lực của kẻ tấn công khi AI tiếp tục phát triển. Điều này sẽ đòi hỏi một nỗ lực to lớn và chưa từng có, nhưng nếu chúng ta cùng nhau đoàn kết, chúng ta có thể mang lại một thế giới an toàn hơn những gì trước đây có thể hình dung.

Tác giả

Greg Brockman