Pasar al contenido principal
OpenAI

7 de agosto de 2026

Seguridad

Cómo responder ante la próxima frontera de las capacidades cibernéticas críticas

Cargando...

La ciberseguridad está cambiando rápidamente a medida que los modelos adquieren capacidades que pueden fortalecer las defensas cibernéticas y, a la vez, permitir ataques a una velocidad y escala sin precedentes.

Nuestras evaluaciones internas más recientes de Astra, uno de nuestros próximos modelos, realizadas durante los últimos días, indican avances significativos en codificación con agentes y ciberseguridad. Estos resultados, junto con las evaluaciones de expertos, nos llevaron a concluir anoche que no podemos descartar capacidades cibernéticas críticas según nuestro Marco de preparación(se abre en una nueva ventana).

Compartimos esta información porque creemos que es importante ser transparentes con el público y con las comunidades de protección y seguridad sobre este posible cambio en las capacidades.

Publicamos por primera vez nuestro Marco de preparación en diciembre de 2023, mucho antes de que los modelos se acercaran a este nivel de capacidades biológicas, químicas, de ciberseguridad y de automejora de la IA. Lo creamos como una guía para identificar avances en las capacidades y planificar lo que haría nuestra empresa a medida que surgieran. Los modelos anteriores, incluido GPT‑5.6‑Sol, se evaluaron para determinar sus capacidades cibernéticas de vanguardia y se clasificaron en el umbral de capacidad Alta, no Crítica.

Medir las capacidades críticas de ciberseguridad 

Según nuestro Marco de preparación, un modelo alcanza el umbral Crítico de ciberseguridad si puede identificar y desarrollar exploits funcionales de día cero de todos los niveles de gravedad en numerosos sistemas críticos reales reforzados, sin intervención humana, o si puede diseñar y ejecutar de principio a fin estrategias novedosas de ciberataque contra objetivos reforzados a partir únicamente de un objetivo general deseado. 

Mientras seguimos sometiendo este modelo a pruebas comparativas y evaluaciones, nuestros resultados preliminares indican un desempeño lo suficientemente sólido como para que, por ahora, no podamos descartar un nivel de capacidad Crítica. Astra es un próximo modelo y no participó en la vulneración de Hugging Face. 

Medidas que estamos tomando

Por consiguiente, ampliamos las pruebas de robustez de nuestras salvaguardas y controles de seguridad para que sean adecuados para implementar estas capacidades. También adoptamos internamente las siguientes medidas para garantizar que el desarrollo posterior de este modelo se lleve a cabo de forma segura: 

  • Estamos implementando controles de seguridad más estrictos para los modelos con mayores capacidades y las actividades relacionadas. Estos incluyen entornos de prueba aislados, acceso restringido a redes y herramientas, mayor protección y cifrado de los pesos del modelo, funciones adicionales de monitoreo y detección, y ejecución en entornos aislados.
  • Estamos pausando las actividades internas relacionadas con Astra que aún no cumplen estos requisitos reforzados de control de seguridad.
  • Implementamos un monitoreo universal de las acciones riesgosas y los desajustes en todas las aplicaciones de Astra basadas en agentes, incluidas las de entrenamiento y evaluación. Los monitores evalúan la cadena de pensamiento del modelo y activan una respuesta de seguridad para revisar e interrumpir las actividades de alto riesgo.
  • Trabajaremos con los organismos gubernamentales pertinentes y determinadas organizaciones de seguridad de la IA para poner a prueba las capacidades de este modelo.
  • Proporcionaremos controles de seguridad recomendados a nuestros socios externos de pruebas para que realicen de forma segura evaluaciones y cargas de trabajo de mayor riesgo. 

El marco ya nos ha orientado en otras transiciones de capacidades. En junio de 2025, cuando nuestros modelos se acercaron al umbral de capacidad Alta para biología según el Marco de preparación, explicamos las medidas que estábamos tomando para reforzar las salvaguardas, ampliar las pruebas, colaborar con expertos externos e implementar controles de seguridad adicionales. Aquí estamos aplicando el mismo principio.

Creemos que los modelos con capacidades cibernéticas avanzadas deben ayudar a los defensores a identificar y corregir vulnerabilidades antes que los atacantes. Nos comprometemos a colaborar con gobiernos, institutos de seguridad y la sociedad civil para garantizar que las capacidades de vanguardia de modelos como Astra y de los que vengan después se implementen de manera responsable y generalizada en beneficio de toda la humanidad.

Autor

OpenAI