پرش به محتوای اصلی
OpenAI

۱۶ مرداد ۱۴۰۵

امنیت

پاسخ به مرز بعدی قابلیت‌های سایبری بحرانی

در حال بارگذاری…

امنیت سایبری به‌سرعت در حال تحول است، زیرا مدل‌ها به قابلیت‌های بیشتری دست می‌یابند که هم می‌توانند دفاع سایبری را تقویت کنند و هم حملات را با سرعت و مقیاسی بی‌سابقه ممکن سازند.

ارزیابی‌های داخلی اخیر ما از Astra، یکی از مدل‌های آینده‌مان، طی چند روز گذشته از پیشرفت‌های چشمگیر در کدنویسی عامل‌محور و امنیت سایبری حکایت دارد. این نتایج، در کنار ارزیابی کارشناسان، ما را دیشب به این نتیجه رساند که نمی‌توان وجود قابلیت‌های سایبری بحرانی را طبق چارچوب آمادگی(در یک پنجره جدید باز می‌شود) خود منتفی دانست.

این موضوع را منتشر می‌کنیم، زیرا معتقدیم شفافیت با عموم مردم و جوامع ایمنی و امنیت درباره این تغییر احتمالی در قابلیت‌ها اهمیت دارد.

ما نخستین‌بار چارچوب آمادگی خود را در دسامبر ۲۰۲۳ منتشر کردیم؛ بسیار پیش از آنکه مدل‌ها در حوزه‌های زیست‌شناسی، شیمی، امنیت سایبری و خودبهسازی هوش مصنوعی به قابلیت‌هایی در این سطح نزدیک شوند. این چارچوب را ایجاد کردیم تا راهنمایی برای شناسایی پیشرفت قابلیت‌ها و سپس برنامه‌ریزی اقدامات شرکت با پدیدارشدن آن‌ها داشته باشیم. مدل‌های پیشین، از جمله GPT‑5.6‑Sol، از نظر قابلیت‌های سایبری پیشرو ارزیابی شده‌اند و در آستانه «بالا» (نه «بحرانی») قرار گرفته‌اند.

سنجش قابلیت‌های بحرانی امنیت سایبری 

طبق چارچوب آمادگی ما، یک مدل زمانی به آستانه بحرانی امنیت سایبری می‌رسد که بتواند بدون دخالت انسان، در شمار زیادی از سامانه‌های حیاتی واقعی و مقاوم‌سازی‌شده، اکسپلویت‌های کاربردی روز صفر را در همه سطوح شدت شناسایی و توسعه دهد؛ یا تنها با دریافت یک هدف کلی، راهبردهایی نو و سرتاسری برای حملات سایبری علیه اهداف مقاوم‌سازی‌شده طراحی و اجرا کند. 

درحالی‌که سنجش و ارزیابی این مدل را ادامه می‌دهیم، ارزیابی‌های اولیه ما عملکردی چنان قدرتمند را نشان می‌دهد که در حال حاضر نمی‌توان سطح قابلیت بحرانی را منتفی دانست. Astra مدلی در دست عرضه است و نقشی در بهره‌برداری از Hugging Face نداشته است. 

اقداماتی که انجام می‌دهیم

بر این اساس، آزمون استحکام تدابیر حفاظتی و کنترل‌های امنیتی خود را گسترش داده‌ایم تا برای استقرار این قابلیت‌ها مناسب باشند. همچنین در داخل مجموعه اقدامات زیر را انجام داده‌ایم تا توسعه بیشتر این مدل به‌شکلی ایمن و امن پیش برود: 

  • برای مدل‌های توانمندتر و فعالیت‌های مرتبط با آن‌ها، کنترل‌های امنیتی سخت‌گیرانه‌تری اجرا می‌کنیم؛ از جمله محیط‌های آزمایشی ایزوله، دسترسی محدود به شبکه و ابزارها، حفاظت و رمزگذاری بهتر وزن‌های مدل، قابلیت‌های بیشتر برای پایش و تشخیص، و اجرای سندباکس‌شده.
  • فعالیت‌های داخلی مرتبط با Astra را که هنوز الزامات این کنترل‌های امنیتی تقویت‌شده را برآورده نمی‌کنند، متوقف کرده‌ایم.
  • برای شناسایی اقدامات پرخطر و ناهم‌راستایی، پایش فراگیری را در همه کاربردهای عامل‌محور Astra، از جمله آموزش و ارزیابی، پیاده‌سازی کرده‌ایم. سامانه‌های پایش، زنجیرهٔ فکر مدل را ارزیابی می‌کنند و برای بررسی و متوقف‌کردن فعالیت‌های پرخطر، واکنش امنیتی را فعال می‌سازند.
  • برای آزمایش قابلیت‌های این مدل، با نهادهای دولتی مرتبط و شماری از سازمان‌های ایمنی هوش مصنوعی همکاری خواهیم کرد.
  • برای شرکای آزمایشی شخص ثالث، کنترل‌های امنیتی توصیه‌شده‌ای ارائه خواهیم کرد تا ارزیابی‌ها و بارهای کاری پرخطرتر را با ایمنی اجرا کنند. 

این چارچوب پیش‌تر نیز ما را در گذارهای دیگرِ قابلیت‌ها راهنمایی کرده است. در ژوئن ۲۰۲۵، هنگامی که مدل‌های ما طبق چارچوب آمادگی به آستانهٔ قابلیت «بالا» در زیست‌شناسی نزدیک شدند، ما اقداماتی را که در پیش گرفته بودیم تشریح کردیم تا تدابیر حفاظتی را تقویت کنیم، آزمایش‌ها را گسترش دهیم، با کارشناسان بیرونی همکاری کنیم و کنترل‌های امنیتی بیشتری اعمال کنیم. در اینجا نیز همین اصل را به کار می‌گیریم.

معتقدیم مدل‌های دارای قابلیت‌های سایبری پیشرفته باید به مدافعان کمک کنند تا آسیب‌پذیری‌ها را پیش از مهاجمان شناسایی و برطرف کنند. متعهدیم با دولت‌ها، مؤسسه‌های ایمنی و جامعه مدنی همکاری کنیم تا قابلیت‌های پیشروی مدل‌هایی مانند Astra و مدل‌های پس از آن، مسئولانه و به‌شکلی گسترده برای منفعت همه بشریت به کار گرفته شوند.

نویسنده

OpenAI