OpenAI lanza GPT-6 Astra, el primer modelo que cruza su propio umbral «crítico» de capacidad cibernética
El salto está en el uso autónomo del ordenador: navega hojas de cálculo, rellena formularios y opera webs a velocidad sobrehumana. El despliegue empezó restringido.

En corto
OpenAI lanzó GPT-6 Astra el 3 de septiembre con un salto en uso autónomo del ordenador y marcas autodeclaradas de 99,9 % en ARC-AGI-3 y 72,6 % en OSWorld 2.0. Es el primer modelo que alcanza el umbral «crítico» del marco interno de la compañía en capacidad cibernética, por lo que el despliegue empezó limitado a clientes del programa Daybreak. API a 10 y 50 dólares por millón de tokens. Los benchmarks son autodeclarados y el umbral es criterio propio, no verificación externa.
Qué significa para ti
La pregunta de compra ha cambiado. No es qué modelo responde mejor, sino a qué sistemas de tu empresa le das acceso — y eso ya no lo decide el equipo técnico solo.
OpenAI presentó GPT-6 Astra el 3 de septiembre. Lo que cambia respecto a la generación anterior no es la conversación: es el uso autónomo del ordenador. El modelo navega hojas de cálculo, rellena formularios y opera sitios web a una velocidad que ningún humano alcanza. Las cifras que publica la compañía: 99,9 % en ARC-AGI-3, 97,6 % en FrontierMath Tier 4, 96,0 % en GPQA Diamond, 72,6 % en OSWorld 2.0 y 57,9 % en Terminal-Bench 4.0.
Es también el primer modelo que alcanza el umbral que la propia OpenAI califica de crítico dentro de su marco interno de preparación en capacidad cibernética. La consecuencia práctica es que la versión estándar rechaza tareas ofensivas avanzadas, y que el despliegue no empezó por el público general: se limitó a clientes del programa de ciberseguridad Daybreak antes de abrirse a Plus, Pro, Business, Enterprise, la API, Azure y AWS Bedrock. En la API cuesta 10 dólares por millón de tokens de entrada y 50 de salida, con un modo Fast al doble de velocidad y de precio.
El eje de la competencia se ha desplazado, y este lanzamiento lo deja claro. Ya no se compra el modelo que mejor responde: se compra el agente que ejecuta trabajo real. Lo que decide la compra pasa a ser otra pregunta, mucho más incómoda para cualquier dirección técnica: a qué sistemas de la empresa le doy acceso, y con qué credenciales.
Los límites de lo anterior. Todos esos porcentajes son autodeclarados y se miden sobre pruebas que eligen los propios laboratorios: sirven para comparar generaciones de un mismo proveedor, no para dictaminar quién es mejor. Y el umbral crítico es el marco de OpenAI clasificando al modelo de OpenAI — no es un veredicto externo, y conviene no leerlo como si lo fuera. El dato de las más de cien mil GPU usadas para entrenarlo en Stargate, en Texas, procede de Fortune y no de la compañía.
Ver los datos
| Concepto | Valor |
|---|---|
| ARC-AGI-3 | 99,9 % |
| FrontierMath Tier 4 | 97,6 % |
| GPQA Diamond | 96 % |
| OSWorld 2.0 | 72,6 % |
| Terminal-Bench 4.0 | 57,9 % |
Qué no dice este gráfico. Son puntuaciones autodeclaradas por OpenAI, medidas en pruebas que la propia compañía elige y sin verificación externa. Sirven para comparar esta generación con las anteriores de OpenAI, no para dictaminar qué modelo es "mejor" frente a otros proveedores: cada barra es un test distinto (ARC-AGI-3, FrontierMath, GPQA Diamond, OSWorld, Terminal-Bench), con su propia dificultad y escala de referencia, así que la altura relativa entre barras no mide una misma capacidad. No incluye el precio de la API (10/50 $ por millón de tokens) ni la cifra de GPU de entrenamiento, por ser de otra unidad y, esta última, de fuente distinta (Fortune, no OpenAI).
Cifras publicadas por OpenAI, autodeclaradas por la propia compañía (recogidas en la nota del 3 de septiembre)
Cómo lo sabemos
Esta nota se verificó con 3 fuentes independientes y fechadas antes de publicarse. El modelo redacta; los hechos vienen de las fuentes.
- OpenAI — GPT-6 Astra · 2026
- OpenAI — GPT-6 Astra System Card: Safety Overview · 2026
- Fortune — OpenAI launches GPT-6 Astra, its most powerful model yet, and touts its ability to use your computer · 2026


