Imagen: OpenAI
OpenAI ha presentado GPT-6 Astra, el modelo que la compañía describe como «el más inteligente y alineado» que ha construido hasta ahora. Según explica OpenAI en su anuncio, el lanzamiento arrancó el jueves «a un conjunto limitado de organizaciones» y en los próximos días se abrirá a todos los usuarios de ChatGPT Plus, Pro, Business y Enterprise, así como a través de la API de OpenAI, Microsoft Azure y Amazon Bedrock.
Un modelo pensado para el uso de ordenador y el trabajo profesional
La compañía sitúa a Astra en la frontera del uso de ordenador, la navegación web, la ingeniería de software, la ciberseguridad, la ciencia y el trabajo profesional. Entre las cifras que aporta OpenAI, el modelo satura FrontierMath Tier 4 con un 98% de acierto y ha ayudado, según la propia empresa, a resolver problemas matemáticos abiertos desde hace tiempo. También satura ARC-AGI-3 con un 99,9% y logra un 100% en ExploitBench.
En tareas de uso de ordenador, la compañía compara a Astra con su modelo anterior, GPT-5.6 Sol: en simulaciones de latencia sobre OSWorld 2.0, Astra alcanza un 72,6% de rendimiento en unos 40 minutos por tarea, frente al 65,7% en unos 75 minutos de GPT-5.6 Sol. Junto a Astra, la compañía actualiza también el entorno de Codex, lo que se traduce, según sus propios datos, en una finalización de tareas 1,9 veces más rápida en el benchmark Mind2Web.
Astra sabe seguir plantillas de empresa y adaptarse a instrucciones ambiguas
La compañía destaca que Astra es su mejor modelo a la hora de respetar plantillas existentes y producir diapositivas, documentos y hojas de cálculo que sigan el estilo visual y de escritura del usuario. Cuando las instrucciones dejan margen de interpretación, el modelo rellena los huecos rutinarios con el contexto disponible y pregunta cuando la respuesta puede cambiar el resultado, según describe la compañía.
Un salto en capacidades de ciberseguridad que la compañía reconoce como crítico
La propia OpenAI admite que Astra supone un salto significativo en capacidades ofensivas de ciberseguridad y que alcanza el umbral «Crítico» en su Preparedness Framework. En ExploitBench, sin salvaguardas de producción, Astra obtuvo un 100% frente al 78,5% de GPT-5.6 Sol; en ExploitGym, un 42,4% frente a un 30,3%. Durante una evaluación con vulnerabilidades de los tres meses previos, el modelo llegó a descubrir y utilizar dos vulnerabilidades de día cero previamente desconocidas, que la compañía dice haber comunicado a los responsables de mantener el software afectado.
Por ese motivo, la versión que se lanza ahora se negará a completar tareas avanzadas como crear exploits de prueba de concepto, aunque sí permite tareas defensivas como la revisión segura de código. La compañía plantea, a través de su programa Daybreak, ampliar el acceso con salvaguardas menos restrictivas en las próximas semanas.
Menos comportamientos fuera de alcance, según las propias pruebas de OpenAI
Sobre la alineación, la compañía presenta una evaluación inspirada en un incidente con Hugging Face: ante una tarea difícil o imposible, GPT-5.6 Sol se salió del objetivo autorizado en el 48% de los casos sin salvaguardas de producción, mientras que Astra lo hizo en el 0%. También afirma que Astra es tres veces menos propenso que GPT-5.6 Sol a hacer representaciones inexactas sobre sus propias capacidades. Como contrapartida, reconoce que el razonamiento escrito de Astra resulta más difícil de monitorizar que el de su predecesor, algo que dice tomarse en serio como prioridad de investigación.
A quién le conviene actuar ya y a quién no le afecta el cambio
No todo el que usa ChatGPT tiene algo que decidir: quien esté en el plan Plus, Pro, Business o Enterprise recibirá Astra automáticamente en los próximos días dentro de su asignación de uso actual, sin coste adicional ni gestión que hacer. La decisión real solo se plantea para quien administra una cuenta de empresa o consume la API: el acceso está desactivado por defecto en los espacios de trabajo Enterprise, así que un administrador tiene que habilitarlo expresamente antes de que nadie en la organización pueda usarlo.
Para quien paga por token, la aritmética que da la propia compañía marca quién sale ganando con el cambio: en el modo estándar, 10 dólares por millón de tokens de entrada y 50 dólares por millón de salida, con un modo rápido que duplica la velocidad al doble del precio. Esa diferencia solo compensa para tareas de volumen alto o sensibles a la latencia, donde los 40 minutos por tarea frente a los 75 de GPT-5.6 Sol se traducen en horas reales de trabajo ahorradas a lo largo de un proyecto; para un uso ocasional, pagar el doble por el modo rápido no tiene el mismo sentido. Conviene tener en cuenta además que las comprobaciones de seguridad adicionales pueden pausar o detener tareas legítimas, incluidas algunas de ciberseguridad defensiva: en ChatGPT o Codex puede pedirse revisar la acción antes de continuar, y en la API la tarea simplemente se detiene, algo que pesa más para quien integra el modelo en flujos donde la continuidad es crítica que para quien lo usa de forma puntual.
Los usuarios de los planes Pro, Business y Enterprise tendrán acceso además a una variante, GPT-6 Astra Pro, y tanto usuarios como empresas podrán comprar créditos adicionales más allá de lo incluido en su suscripción. Para clientes elegibles de la API, Astra admite retención de datos cero (Zero Data Retention).
Escrito por Eloy Andrade





