OpenAI anunció GPT 6 Astra el 3 de septiembre y lo describe como su modelo más inteligente y alineado, orientado a programación, investigación, uso de ordenadores y tareas complejas de varios pasos. La empresa reportó un 98 % en FrontierMath Tier 4, un 99,9 % en ARC AGI 3 y un 100 % en ExploitBench; son resultados d...
Publicado porEditado con GPT-5.6 TerraImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
OpenAI presentó GPT-6 Astra el 3 de septiembre como un modelo para trabajos difíciles y de varios pasos: programación, investigación, uso de ordenadores y flujos profesionales. La compañía lo califica como su modelo más inteligente y alineado hasta ahora, pero no lo abrió de inmediato a todo el público: el despliegue comenzó con un grupo limitado de organizaciones. 2
5
13
La novedad no está solo en los resultados de referencia que comunica la empresa. OpenAI afirma que Astra es el primer modelo suyo que alcanza el nivel Crítico de capacidad cibernética dentro de su Preparedness Framework, su marco interno para evaluar riesgos de sistemas avanzados. Esa clasificación obliga a leer conjuntamente las promesas de capacidad y las restricciones de acceso. 10
12
Según OpenAI, Astra está a la vanguardia en uso de ordenadores, navegación web, ingeniería de software, ciberseguridad, ciencia y trabajo profesional. La documentación para desarrolladores lo orienta a razonamiento complejo, código, investigación y creación de documentos, además de tareas que atraviesan navegadores, herramientas de programación y software profesional. 1
3
13
OpenAI destacó tres resultados:
Estas cifras reflejan evaluaciones publicadas por OpenAI, no mediciones replicadas de forma independiente. Un buen resultado en un benchmark —una prueba estandarizada para comparar modelos— puede indicar avance en las tareas examinadas, pero no demuestra por sí solo inteligencia general, buen juicio en entornos reales ni autonomía segura en cualquier contexto.
OpenAI dice que Astra es su primer modelo que llega al nivel Crítico de capacidad cibernética. Según la definición de la compañía, con las herramientas y los permisos adecuados el modelo puede identificar fallos de seguridad desconocidos previamente y desarrollar nuevas formas de explotarlos en numerosos sistemas bien protegidos, sin que una persona tenga que dirigir cada paso. 10
12
La afirmación tiene dos límites importantes:
OpenAI señala que incorporó protecciones adicionales contra acciones cibernéticas dañinas, incluido un monitoreo reforzado durante el despliegue de Astra. 5
10 El lanzamiento gradual, en lugar de una apertura inmediata y masiva, es coherente con el riesgo adicional que la propia empresa identifica.
OpenAI también presenta Astra como su modelo más alineado: sostiene que respeta mejor los límites de las tareas y comunica con más transparencia. 2
13
Conviene no interpretar esa formulación como una garantía absoluta. En el lanzamiento de un modelo, la alineación se refiere al desempeño observado bajo métodos de entrenamiento y evaluaciones concretos; no asegura que un agente vaya a entender siempre la intención del usuario, respetar todas las fronteras operativas o ser seguro sin supervisión humana. Las notas de lanzamiento indican, precisamente, que Astra incorpora monitoreo adicional para detectar situaciones en las que un agente pueda haber interpretado mal las instrucciones. 5
Para una organización que quiera usar agentes, la pregunta práctica no es solo si el modelo se considera alineado. También importa qué permisos recibe, qué acciones exigen aprobación explícita, cómo se registran sus actividades y con qué rapidez puede detenerse si actúa de forma inesperada.
El material disponible menciona posteriores matices sobre algunas cifras de evaluación, incluidas dudas sobre contaminación de pruebas y diferencias entre configuraciones de acceso especiales y el acceso de producción predeterminado. También alude a pruebas en las que vigilar solo la cadena de razonamiento fue menos eficaz que contar con el contexto completo.
Sin embargo, los extractos de fuentes primarias proporcionados no detallan un historial completo y verificable de cada modificación de resultados ni toda la metodología de monitoreo. La conclusión prudente es que los grandes números de referencia y las evaluaciones de seguridad deben tratarse como evidencia de lanzamiento, susceptible de actualización. Antes de basarse en una puntuación o una condición de despliegue, conviene consultar la documentación y los materiales de seguridad vigentes. 2
3
10
El lanzamiento se produjo después de un incidente previo durante pruebas de seguridad con modelos de OpenAI. La empresa sostiene que Astra no fue el modelo implicado y que incorporó las lecciones de ese episodio a sus salvaguardas. 10
El contexto es relevante porque los sistemas autónomos combinan la capacidad de razonar con la posibilidad de actuar mediante navegadores, herramientas de código y otros programas. Esa capacidad de intervenir en sistemas es parte de su utilidad, pero también aumenta la necesidad de aislamiento, permisos mínimos y supervisión.
OpenAI indicó que Astra empezaría a llegar a un conjunto limitado de organizaciones, con una disponibilidad más amplia prevista posteriormente. 5
13
Para desarrolladores, la página del modelo fija el precio de GPT-6 Astra en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida. También indica una ventana de contexto de 1,05 millones de tokens y un máximo de 128.000 tokens de salida. 3
El acceso en ChatGPT sigue un despliegue independiente y gradual. La documentación de ayuda de OpenAI dice que GPT-6 Pro, impulsado por Astra, se está habilitando para los planes Pro de 100 y 200 dólares, Business y Enterprise. Los planes Plus reciben Astra en ChatGPT Work y Codex a medida que avanza el despliegue. La disponibilidad puede variar entre productos y según la configuración del espacio de trabajo. 6
El anuncio de GPT-6 Astra reúne dos mensajes que no deberían separarse: OpenAI asegura haber dado un salto relevante en trabajo autónomo complejo y, al mismo tiempo, sitúa su capacidad cibernética en el nivel de riesgo más alto que declara públicamente. 10
13
Los resultados de referencia muestran lo que OpenAI afirma que Astra puede hacer bajo sus evaluaciones. El acceso escalonado, el monitoreo adicional y las restricciones cibernéticas muestran que la compañía no considera esas capacidades rutinarias. Para los equipos que evalúen el modelo, la prioridad debería ser un despliegue controlado: herramientas de alcance limitado, aprobaciones explícitas para acciones de impacto, entornos aislados y registros auditables. El rendimiento en pruebas no se traduce automáticamente en autonomía fiable.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
OpenAI anunció GPT 6 Astra el 3 de septiembre y lo describe como su modelo más inteligente y alineado, orientado a programación, investigación, uso de ordenadores y tareas complejas de varios pasos.
OpenAI anunció GPT 6 Astra el 3 de septiembre y lo describe como su modelo más inteligente y alineado, orientado a programación, investigación, uso de ordenadores y tareas complejas de varios pasos. La empresa reportó un 98 % en FrontierMath Tier 4, un 99,9 % en ARC AGI 3 y un 100 % en ExploitBench; son resultados de evaluaciones publicadas por OpenAI, no réplicas independientes.
Astra es el primer modelo que OpenAI clasifica en el nivel “Crítico” de capacidad cibernética.