الاستجابة للمرحلة التالية من القدرات السيبرانية الحرجة
يشهد الأمن السيبراني تغيرًا سريعًا مع ازدياد قدرات النماذج بطرق يمكنها تعزيز الدفاعات السيبرانية وتمكين الهجمات بسرعة ونطاق غير مسبوقين.
تشير أحدث تقييماتنا الداخلية لنموذج Astra، وهو أحد نماذجنا المرتقبة، خلال الأيام القليلة الماضية إلى تقدم كبير في البرمجة الوكيلة والأمن السيبراني. دفعتنا هذه النتائج، إلى جانب تقييمات الخبراء، إلى أن نستنتج الليلة الماضية أنه لا يمكننا استبعاد امتلاك النموذج قدرات سيبرانية حرجة وفق إطار الجاهزية(يفتح في نافذة جديدة) لدينا.
نشارك هذه المعلومات لأننا نرى أهمية التحلي بالشفافية مع الجمهور ومجتمعات السلامة والأمن بشأن هذا التحول المحتمل في القدرات.
نشرنا إطار الجاهزية لأول مرة في ديسمبر 2023، قبل وقت طويل من اقتراب النماذج من هذا المستوى من القدرات البيولوجية والكيميائية والسيبرانية وقدرات التحسين الذاتي للذكاء الاصطناعي. وقد وضعناه ليكون دليلًا يساعدنا على رصد تطور القدرات، ثم التخطيط لما ستفعله شركتنا عند ظهورها. خضعت نماذج سابقة، منها GPT‑5.6‑Sol، لتقييم قدراتها السيبرانية الرائدة، وصُنفت عند عتبة «عالٍ» بدلًا من عتبة «حرج».
وفق إطار الجاهزية، يبلغ النموذج العتبة الحرجة للأمن السيبراني إذا استطاع، دون تدخل بشري، اكتشاف وتطوير برمجيات استغلال فعّالة لثغرات يوم الصفر بمختلف درجات الخطورة في العديد من الأنظمة الحيوية المحصنة المستخدمة فعليًا، أو ابتكار استراتيجيات جديدة ومتكاملة للهجمات السيبرانية على أهداف محصنة وتنفيذها، انطلاقًا من هدف عام مطلوب فحسب.
بينما نواصل قياس أداء هذا النموذج وتقييمه، تشير تقييماتنا الأولية إلى أن أداءه قوي بما يكفي لعدم تمكّننا حاليًا من استبعاد بلوغه مستوى القدرات الحرجة. Astra نموذج مرتقب، ولم يشارك في استغلال Hugging Face.
وبناءً على ذلك، وسّعنا نطاق اختبارات متانة تدابير الحماية وضوابط الأمن لدينا لتناسب نشر هذه القدرات. واتخذنا داخليًا أيضًا الخطوات التالية لضمان مواصلة تطوير هذا النموذج بأمان وعلى نحو مأمون:
- نطبّق ضوابط أمنية أكثر صرامة على النماذج الأعلى قدرة والأنشطة المرتبطة بها، بما يشمل بيئات اختبار معزولة، وتقييد الوصول إلى الشبكات والأدوات، وتعزيز حماية أوزان النموذج وتشفيرها، وإضافة قدرات للمراقبة والكشف، والتنفيذ داخل بيئات معزولة.
- نعلّق الأنشطة الداخلية التي تتضمن Astra ولا تستوفي بعد متطلبات ضوابط الأمن المعززة هذه.
- طبّقنا مراقبة شاملة للأفعال الخطرة وحالات عدم المواءمة في جميع تطبيقات Astra القائمة على الوكلاء، بما فيها التدريب والتقييم. تقيّم أنظمة المراقبة سلسلة أفكار النموذج، وتطلق استجابة أمنية لمراجعة الأنشطة عالية الخطورة وإيقافها.
- سنتعاون مع الجهات الحكومية المعنية ومجموعة مختارة من مؤسسات سلامة الذكاء الاصطناعي لاختبار قدرات هذا النموذج.
- سنزوّد شركاء الاختبار الخارجيين بضوابط الأمن الموصى بها لإجراء التقييمات وتشغيل أعباء العمل الأعلى خطورة بأمان.
لقد أرشدنا الإطار بالفعل خلال تحولات أخرى في القدرات. في يونيو 2025، عندما اقتربت نماذجنا من عتبة القدرات العالية في علم الأحياء وفق إطار الجاهزية، عرضنا الخطوات التي كنا نتخذها لتعزيز تدابير الحماية، وتوسيع نطاق الاختبارات، والعمل مع خبراء خارجيين، وتطبيق ضوابط أمنية إضافية. ونطبّق المبدأ نفسه هنا.
نعتقد أن النماذج المتقدمة ذات القدرات السيبرانية ينبغي أن تساعد المدافعين على اكتشاف الثغرات ومعالجتها قبل المهاجمين. نلتزم بالعمل جنبًا إلى جنب مع الحكومات ومعاهد السلامة والمجتمع المدني لضمان نشر القدرات الرائدة لنماذج مثل Astra وما يليها بمسؤولية وعلى نطاق واسع لما فيه خير البشرية جمعاء.


