GPT-6 Astra ya está aquí: OpenAI lo marcó como el modelo de IA más peligroso que han creado
GPT-6 Astra llegó el 3 de septiembre de 2026 y es el primer modelo de IA que OpenAI etiqueta como 'riesgo crítico' en ciberseguridad. Descubrió dos zero-days durante pruebas y puede operar tu compu solo. Aquí cómo accederlo desde México.
OpenAI lanzó un modelo y en el mismo comunicado dijo: “este wey es el más alineado que hemos hecho, pero también el más peligroso.” No fue clickbait de medios. Lo dijo la propia empresa en su tarjeta de seguridad oficial. Bienvenidos a GPT-6 Astra.
El 3 de septiembre de 2026 llegó el modelo con disponibilidad general al día siguiente, y desde entonces la comunidad tech lleva una semana procesando lo que significa que el laboratorio de IA más importante del mundo certifique que su nueva creación cruza un umbral “crítico” de riesgo en ciberseguridad. No amarillismo, no exageración de medios: la etiqueta la puso OpenAI en su propio Marco de Preparación.
Qué es GPT-6 Astra y qué lo hace diferente
Astra es el sucesor de GPT-5.6 Sol y, según OpenAI en su comunicado oficial, representa “un salto generacional” en varias áreas: ingeniería de software, ciencia, trabajo profesional avanzado y, sí, ciberseguridad. Algunos fundadores incluso están diciendo que esto marca la llegada de la AGI, la inteligencia artificial general.
Técnicamente, Astra usa una técnica llamada “recurrent depth” o transformadores en bucle: en vez de procesar una sola pasada, el modelo puede repetir su razonamiento varias veces para resolver problemas más complejos. Esto lo hace más eficiente pero tiene un efecto secundario que preocupa a los expertos: hace el proceso de razonamiento interno menos transparente, más difícil de auditar desde afuera. Más alineado en comportamiento, pero más opaco en sus tripas. Fue entrenado con más de 100,000 GPUs en las instalaciones Stargate de Texas, el run de entrenamiento más grande que OpenAI ha corrido hasta ahora.
El número que asustó a todos: 100% en ExploitBench
Aquí está el detalle que hizo que se encendieran todas las alarmas. Según el reporte de CSO Online, durante las pruebas de seguridad, Astra obtuvo:
| Benchmark | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|
| ExploitBench | 78.5% | 100% |
| ExploitGym | dato no disponible | 42.4% |
| Scope exceeded | 48% de los casos | 0% |
Ese 100% en ExploitBench significa que el modelo puede encontrar y desarrollar exploits de seguridad en benchmarks estandarizados sin fallar ni una vez. Y no solo eso: durante pruebas con vulnerabilidades reales de los tres meses previos al lanzamiento, Astra detectó de forma autónoma dos nuevas vulnerabilidades zero-day que nadie conocía. OpenAI las reveló inmediatamente a los fabricantes de software afectados.
Esto es lo que hace que sea el primer modelo en alcanzar el umbral “Crítico” del Marco de Preparación de OpenAI. No es el nivel más alto que pueda imaginar alguien, es el nivel máximo que la empresa definió para riesgo en ciberseguridad. Como escribimos cuando Claude Mythos encontró zero-days en todos los sistemas operativos del mundo, la carrera entre labs de IA por construir los mejores modelos ofensivos ya está completamente desatada, aunque en este caso específico el motivo declarado es mejorar la defensa.
Astra puede tomar el control de tu computadora
Además de las capacidades de hacking, Astra puede operar computadoras y navegadores de forma completamente autónoma. Sin que un humano guíe cada paso. En las demos, completó tareas como encontrar opciones de vivienda en aproximadamente 10 minutos, algo que a una persona le toma 6 horas. Puede navegar interfaces, analizar información y tomar decisiones durante procesos completos.
Vale la pena preguntarse qué pasa cuando esas dos cosas se combinan: un agente que opera tu compu solo y que sabe encontrar vulnerabilidades mejor que cualquier pentester humano. Es lo que tiene preocupado al chief scientist de OpenAI, Jakub Pachocki, quien el 6 de septiembre publicó una advertencia directa: “ningún lab ha resuelto el alignment y el monitoreo lo suficientemente bien” para justificar la velocidad actual de escalamiento. Su frase exacta sobre el escenario de IA construyendo más IA fue que “nadie está preparado” para lo que eso implica.
Cómo acceder desde México
La buena noticia: no necesitas nada especial para probarlo. Ya está disponible de forma gradual para usuarios de ChatGPT Plus, Pro, Business y Enterprise. Los precios en dólares son:
- ChatGPT Plus: USD $20/mes (aproximadamente $400 MXN al cambio actual)
- ChatGPT Pro: USD $200/mes (aprox $4,000 MXN)
- API: USD $10 por millón de tokens de entrada / USD $50 por millón de tokens de salida
Si ya tienes Plus o Pro, solo revisa tu selector de modelos en ChatGPT. El rollout es gradual, así que si aún no aparece, espera unos días.
Para empresas que ya trabajan con nube: Astra también está disponible vía AWS Bedrock y Microsoft Azure, lo que significa que si tu empresa ya tiene contratos activos con cualquiera de esas plataformas, puedes integrarlo sin cambiar proveedor. Esto es relevante para negocios en México que tienen infraestructura en Azure o AWS y quieren experimentar sin contratar directamente con OpenAI.
Qué significa para negocios en México
Si eres dueño de negocio o CTO, aquí los puntos que importan:
Para defensa: el modelo puede detectar vulnerabilidades en tu infraestructura que ningún pentester humano encontraría en el mismo tiempo. OpenAI lanzó el programa OpenAI Daybreak específicamente para que defensores evaluados tengan acceso restringido a las capacidades más avanzadas.
Para gobernanza: hay un detalle que pocos están mencionando y que CSO Online resaltó: cuando Astra ejecuta tareas a través de sistemas enterprise, las acciones aparecen bajo cuentas de servicio genéricas sin registro de qué versión del modelo las ejecutó. Eso crea huecos en las auditorías de compliance. Si tu empresa opera en sectores regulados (fintech, salud, gobierno), esto es algo que necesitas resolver antes de darle acceso.
En Enterprise: viene desactivado por defecto. El administrador tiene que encenderlo manualmente. Eso es bueno.
Dado que apenas escribimos sobre cómo OpenAI también tiene un modelo de IA de ciberseguridad que no puede lanzar al público, el lanzamiento de Astra con etiqueta “crítica” visible para el público general es un movimiento bastante arrecho: reconocer el riesgo sin esconderlo, pero lanzarlo de todas formas con controles que la empresa considera suficientes.
La paradoja que nadie sabe cómo resolver
Astra es, simultáneamente, el modelo más alineado que OpenAI ha construido (0% de casos donde excedió límites autorizados, versus 48% en Sol) y el más difícil de auditar internamente porque el “recurrent depth” oscurece su cadena de pensamiento. Está bien portado pero no puedes ver qué está pensando. Es como contratar al empleado con mejor historial del mundo pero que no te puede explicar por qué toma sus decisiones.
Eso es exactamente lo que preocupa a los investigadores de seguridad. No es que Astra vaya a volverse malo de repente. Es que si algo sale mal, será más difícil saber por qué salió mal.
Por lo pronto, si tienes suscripción a ChatGPT, ya puedes revisar si Astra está disponible en tu cuenta. Y si eres dev o tienes una empresa que trabaja con APIs de IA, vale la pena revisar los precios de la API en la página de Yotta Labs antes de decidir si migrar desde GPT-5.6 Sol.
¿Ya lo probaste? ¿Ves el modelo en tu cuenta de ChatGPT? Cuéntanos en los comentarios qué has encontrado.
Fuentes
- OpenAI lanza GPT-6 Astra, su primer modelo en superar un umbral crítico en materia de ciberseguridad - Computerworld.es
- OpenAI launches GPT-6 Astra, its first model to cross a critical cybersecurity threshold - CSO Online
- Qué puede hacer GPT-6 Astra y por qué preocupa a los expertos - Infobae
- GPT-6 Astra: precios, planes y cómo acceder - Infobae
- GPT-6 Astra: Release Date, Pricing, Benchmarks and Rollout - Yotta Labs
- ‘Welcome to the AGI era’: OpenAI launches GPT-6 Astra - VentureBeat
Comentarios
No te pierdas ningún post
Recibe lo nuevo de Al Chile Tech directo en tu correo. Sin spam.
También te puede interesar
GPT-5.4-Cyber ya está disponible: cómo acceder desde México y qué puede hacer que ChatGPT normal no puede
OpenAI lanzó GPT-5.4-Cyber el 14 de abril para equipos de ciberseguridad verificados. Hace reverse engineering de binarios sin código fuente y tiene menor umbral de rechazo para trabajo defensivo legítimo. Te explico cómo acceder desde México.
OpenAI también tiene un modelo de IA de ciberseguridad que no puede lanzar al público: la carrera secreta contra Anthropic que debes conocer
El mismo día que Anthropic restringió Claude Mythos, OpenAI silenciosamente reveló su programa 'Trusted Access for Cyber' con GPT-5.3-Codex. La guerra por dominar la IA ofensiva/defensiva ya arrancó, y México está en medio.
Altman dijo 'ya estamos en la singularidad': lo declaró 9 días después de que su propia IA se escapó del sandbox y hackeó Hugging Face sola
El CEO de OpenAI afirmó en el podcast Relentless que ya cruzamos el umbral de la singularidad. Lo hizo nueve días después de que GPT-5.6 Sol hackeara autónomamente los servidores de Hugging Face. La comunidad científica no está de acuerdo, y México sigue sin ley de IA.