پاسخ به مرز بعدی قابلیتهای سایبری بحرانی
امنیت سایبری بهسرعت در حال تحول است، زیرا مدلها به قابلیتهای بیشتری دست مییابند که هم میتوانند دفاع سایبری را تقویت کنند و هم حملات را با سرعت و مقیاسی بیسابقه ممکن سازند.
ارزیابیهای داخلی اخیر ما از Astra، یکی از مدلهای آیندهمان، طی چند روز گذشته از پیشرفتهای چشمگیر در کدنویسی عاملمحور و امنیت سایبری حکایت دارد. این نتایج، در کنار ارزیابی کارشناسان، ما را دیشب به این نتیجه رساند که نمیتوان وجود قابلیتهای سایبری بحرانی را طبق چارچوب آمادگی(در یک پنجره جدید باز میشود) خود منتفی دانست.
این موضوع را منتشر میکنیم، زیرا معتقدیم شفافیت با عموم مردم و جوامع ایمنی و امنیت درباره این تغییر احتمالی در قابلیتها اهمیت دارد.
ما نخستینبار چارچوب آمادگی خود را در دسامبر ۲۰۲۳ منتشر کردیم؛ بسیار پیش از آنکه مدلها در حوزههای زیستشناسی، شیمی، امنیت سایبری و خودبهسازی هوش مصنوعی به قابلیتهایی در این سطح نزدیک شوند. این چارچوب را ایجاد کردیم تا راهنمایی برای شناسایی پیشرفت قابلیتها و سپس برنامهریزی اقدامات شرکت با پدیدارشدن آنها داشته باشیم. مدلهای پیشین، از جمله GPT‑5.6‑Sol، از نظر قابلیتهای سایبری پیشرو ارزیابی شدهاند و در آستانه «بالا» (نه «بحرانی») قرار گرفتهاند.
طبق چارچوب آمادگی ما، یک مدل زمانی به آستانه بحرانی امنیت سایبری میرسد که بتواند بدون دخالت انسان، در شمار زیادی از سامانههای حیاتی واقعی و مقاومسازیشده، اکسپلویتهای کاربردی روز صفر را در همه سطوح شدت شناسایی و توسعه دهد؛ یا تنها با دریافت یک هدف کلی، راهبردهایی نو و سرتاسری برای حملات سایبری علیه اهداف مقاومسازیشده طراحی و اجرا کند.
درحالیکه سنجش و ارزیابی این مدل را ادامه میدهیم، ارزیابیهای اولیه ما عملکردی چنان قدرتمند را نشان میدهد که در حال حاضر نمیتوان سطح قابلیت بحرانی را منتفی دانست. Astra مدلی در دست عرضه است و نقشی در بهرهبرداری از Hugging Face نداشته است.
بر این اساس، آزمون استحکام تدابیر حفاظتی و کنترلهای امنیتی خود را گسترش دادهایم تا برای استقرار این قابلیتها مناسب باشند. همچنین در داخل مجموعه اقدامات زیر را انجام دادهایم تا توسعه بیشتر این مدل بهشکلی ایمن و امن پیش برود:
- برای مدلهای توانمندتر و فعالیتهای مرتبط با آنها، کنترلهای امنیتی سختگیرانهتری اجرا میکنیم؛ از جمله محیطهای آزمایشی ایزوله، دسترسی محدود به شبکه و ابزارها، حفاظت و رمزگذاری بهتر وزنهای مدل، قابلیتهای بیشتر برای پایش و تشخیص، و اجرای سندباکسشده.
- فعالیتهای داخلی مرتبط با Astra را که هنوز الزامات این کنترلهای امنیتی تقویتشده را برآورده نمیکنند، متوقف کردهایم.
- برای شناسایی اقدامات پرخطر و ناهمراستایی، پایش فراگیری را در همه کاربردهای عاملمحور Astra، از جمله آموزش و ارزیابی، پیادهسازی کردهایم. سامانههای پایش، زنجیرهٔ فکر مدل را ارزیابی میکنند و برای بررسی و متوقفکردن فعالیتهای پرخطر، واکنش امنیتی را فعال میسازند.
- برای آزمایش قابلیتهای این مدل، با نهادهای دولتی مرتبط و شماری از سازمانهای ایمنی هوش مصنوعی همکاری خواهیم کرد.
- برای شرکای آزمایشی شخص ثالث، کنترلهای امنیتی توصیهشدهای ارائه خواهیم کرد تا ارزیابیها و بارهای کاری پرخطرتر را با ایمنی اجرا کنند.
این چارچوب پیشتر نیز ما را در گذارهای دیگرِ قابلیتها راهنمایی کرده است. در ژوئن ۲۰۲۵، هنگامی که مدلهای ما طبق چارچوب آمادگی به آستانهٔ قابلیت «بالا» در زیستشناسی نزدیک شدند، ما اقداماتی را که در پیش گرفته بودیم تشریح کردیم تا تدابیر حفاظتی را تقویت کنیم، آزمایشها را گسترش دهیم، با کارشناسان بیرونی همکاری کنیم و کنترلهای امنیتی بیشتری اعمال کنیم. در اینجا نیز همین اصل را به کار میگیریم.
معتقدیم مدلهای دارای قابلیتهای سایبری پیشرفته باید به مدافعان کمک کنند تا آسیبپذیریها را پیش از مهاجمان شناسایی و برطرف کنند. متعهدیم با دولتها، مؤسسههای ایمنی و جامعه مدنی همکاری کنیم تا قابلیتهای پیشروی مدلهایی مانند Astra و مدلهای پس از آن، مسئولانه و بهشکلی گسترده برای منفعت همه بشریت به کار گرفته شوند.


