domingo, 9 de agosto de 2026 · Edición #185
miuranews

El briefing diario de inteligencia artificial en español

Modelos

OpenAI frena su próximo modelo por riesgo cibernético "crítico": el primero que alcanza ese nivel

OpenAI pausa parte del desarrollo de Astra, un modelo aún sin lanzar, al no poder descartar que sea capaz de atacar por su cuenta sistemas bien protegidos. Sería el primero en su nivel máximo de riesgo.

Gonzalo
Gonzalo· Fundador
· 3 min de lectura
Chat GPT

Las claves

  • El 7 de agosto, OpenAI anunció que pausa parte del trabajo interno sobre Astra, un modelo aún sin lanzar, por su capacidad en ciberseguridad.
  • Es el primer modelo que la empresa clasifica en el nivel "crítico" de su marco de seguridad; los anteriores, incluido GPT-5.6 Sol, quedaban un escalón por debajo.
  • OpenAI no ha confirmado que Astra cruce el umbral —dice que "no puede descartarlo"— ni ha publicado los resultados de las pruebas.

OpenAI anunció el 7 de agosto que pausa parte del desarrollo interno de Astra, uno de sus próximos modelos, todavía sin lanzar, tras detectar en sus evaluaciones que podría ser capaz de identificar y ejecutar ciberataques por su cuenta contra sistemas del mundo real bien protegidos. La empresa lo trata como su primer modelo de nivel "crítico" en ciberseguridad, el escalón más alto de su marco de seguridad interno. Todos los modelos anteriores que evaluó para capacidad ofensiva, incluido su buque insignia GPT-5.6 Sol, se habían quedado un peldaño por debajo.

Qué ha activado la alarma

Las pruebas más recientes mostraron avances marcados en dos áreas: la programación autónoma y la ciberseguridad. La segunda fue la que hizo saltar el aviso. Según la empresa, Astra podía encontrar debilidades en sistemas reales y explotarlas sola, incluso frente a defensas sólidas. Su marco de seguridad define ese nivel "crítico" como la capacidad de descubrir y desarrollar por sí mismo vulnerabilidades desconocidas —los llamados días cero— en muchos sistemas críticos endurecidos, o de planificar y ejecutar ciberataques sofisticados de principio a fin sin ayuda humana.

Ante eso, OpenAI dice haber reforzado los controles: entornos de prueba aislados, vigilancia universal de todos los usos del modelo por parte de agentes y colaboración con agencias gubernamentales y grupos independientes de seguridad para validar sus capacidades antes de cualquier lanzamiento. Informó además de forma voluntaria a la Administración de su intención de retrasarlo. Y aclaró un punto: Astra no tuvo nada que ver con el asalto a Hugging Face de hace unas semanas.

Por qué es un momento inusual

Lo relevante no es solo la capacidad, sino la decisión. Puede ser la primera vez que un gran laboratorio frena públicamente uno de sus propios modelos por motivos de ciberseguridad, y que lo haga con un sistema que ni siquiera ha salido. El argumento de fondo de OpenAI es que un modelo capaz de atacar también es capaz de defender, y que conviene que sirva primero para cerrar agujeros antes de que los aprovechen los atacantes.

Dónde conviene el escepticismo

Ahora, la letra pequeña. OpenAI no ha confirmado que Astra sea "crítico": dice que "no puede descartarlo", y no ha publicado los resultados de las evaluaciones que sostendrían esa etiqueta. Es una autorregulación voluntaria y opaca, difícil de verificar desde fuera, que llega en plena ola de titulares sobre seguridad de la IA; cabe leerla como cautela sincera y, a la vez, como un gesto que refuerza su imagen de laboratorio responsable. Conviene sostener las dos ideas.

Y hay un contraste que ayuda a calibrar. Anthropic se había comprometido a pausar el entrenamiento de modelos muy potentes si sus capacidades superaban su capacidad de controlarlos, pero suavizó ese compromiso al actualizar su política de escalado responsable en febrero. Es decir, los frenos voluntarios existen, pero son reversibles y los fija cada empresa a su medida. Mientras no haya un estándar externo y verificable, "nos frenamos por seguridad" seguirá dependiendo de la palabra de quien lo dice.

Fuentes

Enlaces a las fuentes originales en las que se apoya esta noticia. Contrasta cada dato en su origen.

EtiquetasOpenAICiberseguridad

Preguntas frecuentes

¿Qué es el modelo Astra y por qué lo ha pausado OpenAI?
Astra es un modelo de OpenAI aún sin lanzar. La empresa pausó parte de su desarrollo el 7 de agosto de 2026 porque sus pruebas indican que podría atacar por su cuenta sistemas informáticos bien protegidos, alcanzando el nivel "crítico" de ciberseguridad de su marco de seguridad interno.
¿Significa esto que Astra es peligroso o incontrolable?
No exactamente. OpenAI dice que no puede descartar que alcance ese nivel, no que lo haya confirmado, y no ha publicado los datos. Ha reforzado los controles y avisado al Gobierno. Es una medida de precaución sobre un modelo que no está en el mercado.
¿Afecta esto a los usuarios de ChatGPT?
No. Astra es un modelo en desarrollo, distinto de los que hoy usan los clientes. La decisión afecta a su desarrollo interno y a su posible lanzamiento futuro, no a los servicios actuales de la empresa.
Gonzalo

GonzaloFundador

Madrileño enganchado a la tecnología desde pequeño. Trabajo en finanzas pero la inteligencia artificial es lo que me quita el sueño. Creé Miuranews para seguirla de cerca y contarla en español sin hype.

Todos sus artículos →

◈ Asistente Miuranews

Pregunta sobre este artículo

Respuestas basadas en esta pieza y en el archivo de Miuranews. Sin inventar: si no está cubierto, te lo dice.

Prueba una

Experimento en beta · No sustituye a la lectura del artículo