OpenAI presenta GPT-6 Astra, su modelo más capaz, con mejoras en autonomía, uso del ordenador y seguridad. Llega de forma gradual, primero a organizaciones y luego a usuarios de ChatGPT.
OpenAI ha presentado GPT-6 Astra, al que define como el modelo más capaz que ha desplegado hasta ahora. La nueva generación se centra en ir más allá de responder preguntas o razonar: puede usar ordenadores, navegar por Internet, programar, investigar y completar trabajos complejos de principio a fin. Según publica MuyComputer, Astra es capaz de rellenar formularios, actualizar registros en un CRM, organizar calendarios, analizar datos, crear gráficos, construir páginas web o instalar y probar software, con una autonomía muy superior a la de generaciones anteriores.
El despliegue es gradual: primero llega a un grupo limitado de organizaciones y posteriormente a usuarios de ChatGPT Plus, Pro, Business y Enterprise, además de la API, Microsoft Azure y AWS Bedrock.
En el uso del ordenador, Astra marca diferencias frente a GPT-5.6 Sol. En el benchmark OSWorld 2.0 consigue un 72,6% frente al 65,7% de su predecesor, y completa las tareas en unos 40 minutos de media, frente a los 75 minutos de Sol, una reducción cercana al 47%. Con la actualización del entorno de Codex, Astra completa las pruebas de Mind2Web 1,9 veces más rápido. La compañía sostiene que la nueva generación está pensada para delegar procesos completos, no solo acciones aisladas.
En el ámbito profesional, Astra ha recibido entrenamiento específico para producir presentaciones, hojas de cálculo, documentos y análisis que respeten plantillas, estilos e instrucciones existentes. También mejora a la hora de decidir qué información es relevante para cada entrega, puede incorporar nuevas indicaciones sin perder el objetivo original y, dentro de Codex, puede solicitar una aclaración mientras continúa con las partes que no dependen de la respuesta. Para sesiones largas, estrena un sistema experimental de notas persistentes que conserva información entre ventanas de contexto.
Los resultados en benchmarks son llamativos: 99,9% en ARC-AGI-3, 97,6% en FrontierMath Tier 4 y 100% en ExploitBench, mientras que Sol obtenía un 7,8% en el primero. OpenAI advierte de que los resultados dependen de los entornos y configuraciones, y que las pruebas en su entorno de investigación pueden diferir de la experiencia en ChatGPT. Además, Astra no lidera todas las comparativas: en Humanity’s Last Exam con herramientas logra un 57,2%, por debajo de algunos modelos Claude incluidos en su propia tabla.
En ciencia y matemáticas, OpenAI atribuye a Astra participación en dos avances sobre distancias entre números primos: ayudó a reducir de 240 a 186 una cota sobre pares de primos cercanos, y mejoró un término para estudiar separaciones excepcionalmente grandes que llevaba más de 80 años sin modificarse. Astra alcanza un 64,6% en Terminal-Bench Science 0.1 y un 96% en GPQA Diamond.
La seguridad es otro de los focos. GPT-6 Astra es el primer modelo de OpenAI que alcanza el nivel Critical en capacidades de ciberseguridad dentro de su Preparedness Framework. Sin protecciones de producción, obtuvo un 100% en ExploitBench y un 42,4% en ExploitGym, y en una evaluación con vulnerabilidades recientes descubrió y utilizó dos vulnerabilidades zero-day que OpenAI afirma estar comunicando a sus responsables. La compañía ha reforzado el aislamiento, la supervisión y las restricciones alrededor del modelo. Para profesionales y organizaciones verificadas existe Daybreak, un programa que amplía progresivamente las capacidades para trabajo defensivo autorizado.
La disponibilidad general para usuarios de ChatGPT se espera en las próximas semanas, aunque OpenAI no ha precisado una fecha exacta para cada plan.


