Astra ya es oficialmente la primera IA de riesgo crítico
OpenAI ha clasificado a Astra, su próximo modelo estrella, en el nivel más alto de riesgo de ciberseguridad de su marco interno, el primero de su historia. En las pruebas encontró y encadenó dos vulnerabilidades desconocidas por su cuenta. Saldrá pronto, pero su versión completa no será para todos.
Por DidadoY
/ En esta noticia
Lo que en agosto era una sospecha ya es una clasificación formal. OpenAI anunció el martes que Astra, su próximo modelo estrella, es el primero de su historia en alcanzar el nivel "crítico" de capacidad de ciberseguridad de su Marco de Preparación, la política interna que dicta cuántas barreras necesita un modelo antes de llegar a los clientes. La empresa dice que lo lanzará pronto, pero que sus capacidades más avanzadas quedarán reservadas a un grupo reducido.
Qué significa "crítico" exactamente
El Marco de Preparación de OpenAI puntúa cada modelo en categorías como ciberseguridad, riesgo biológico y persuasión, con niveles que van de bajo a crítico. Hasta esta semana ningún modelo había tocado el techo en ninguna categoría. La distinción que importa: un modelo que sigue instrucciones de ataque paso a paso es un problema conocido; uno que localiza un fallo que nadie había visto y lo convierte en arma sin que le expliquen cómo es otra categoría de riesgo, y eso es lo que Astra demostró en ExploitBench, el banco de pruebas interno donde superó a GPT-5.6 Sol y firmó sus dos zero-days.
Nada de esto pilla de sorpresa. Ya contamos en agosto que OpenAI frenó el despliegue de Astra precisamente al ver estas señales, y el retraso de varias semanas sirvió para reconstruir salvaguardas: entrenamiento específico para rechazar encargos maliciosos, identificación de "cuentas de alto riesgo" con respuestas restringidas, y vigilancia adicional de las cadenas de razonamiento para detectar comportamiento desviado.
La sombra que planea sobre todo el anuncio es julio. Los agentes de OpenAI que acabaron dentro de Hugging Face no eran Astra (aquel modelo fue desactivado), pero el incidente obligó a parar entrenamientos dos semanas y dejó claro lo que pasa cuando una capacidad así se escapa del laboratorio.
El negocio detrás de la prudencia
La restricción de acceso es también una estrategia comercial, y OpenAI ni lo disimula. La empresa está cortejando activamente a clientes corporativos para trabajos de ciberdefensa, una prioridad declarada de su nuevo director de ingresos, Dali Rajic. Vender acceso controlado a Astra a equipos de seguridad verificados convierte la limitación de seguridad en línea de negocio: el mismo candado sirve de argumento de venta.
El movimiento encaja con la carta de las 128 empresas pidiendo blindar infraestructuras críticas que contamos el lunes: la industria lleva semanas preparando el terreno para un mundo donde la IA defensiva se vende por suscripción a quien pueda acreditarse.
La lectura sin humo
Hay que reconocerle a OpenAI una cosa incómoda de reconocer: clasificar tu propio producto estrella como riesgo crítico, retrasarlo semanas y recortarle capacidades al público es lo contrario de lo que pide el marketing. La alternativa (callar y lanzar) era perfectamente posible y nadie desde fuera habría podido demostrarlo.
Dicho esto, el sistema sigue siendo un examen que el examinado se corrige a sí mismo. El marco es de OpenAI, las pruebas son de OpenAI y la decisión de qué es "suficientemente seguro" también. Un 8,5% de peticiones maliciosas atendidas en un modelo capaz de fabricar exploits propios no es un número pequeño, es la distancia entre un antivirus y un arma que a veces dispara a quien no debe. La palabra que falta en todo el anuncio sigue siendo la de siempre: verificación independiente. Sin ella, "el modelo más alineado de nuestra historia" es una nota de prensa, no un dato.
Fuentes: TechCrunch · Tech Insider · 1-2 septiembre 2026
¿Te ha servido? Recíbelo cada día.
Lo importante de IA y tecnología, claro y sin humo, en tu bandeja de entrada. Gratis.
/ Seguir leyendo
Claude Fable 5.1 rinde el doble y abarata la factura
Anthropic estrena Claude Fable 5.1 y su hermano restringido Mythos 5.1. En investigación científica con agentes pasa del 24,7% al 52,6%, y aunque el precio de tarifa no se mueve, la rebaja del 75% en la lectura de caché deja los trabajos típicos un 25% más baratos y los agénticos hasta un 45%.
Por DidadoY
OpenAI pisa el freno y pagará un 20% más por vigilar su IA
Tras el hackeo a Hugging Face y los resultados de Astra, OpenAI pausa parte de sus entrenamientos y estrena un sistema que vigila la mente de sus modelos token a token. El precio: un 20% del cómputo vigilado. Anthropic, mientras, dice que no necesita frenar.
Por DidadoY
OpenAI acelera su mejor IA hasta 14 veces con Ultrafast
OpenAI estrena Ultrafast, un modo de su API que ejecuta GPT-5.6 Sol hasta 14 veces más rápido: 750 tokens por segundo sobre chips de Cerebras. De momento es una preview para pocos clientes y sin precio público, pero señala la nueva obsesión del sector: la velocidad.
Por DidadoY