A OpenAI lançou o GPT 6 Astra em 3 de setembro com acesso inicial limitado, chamando o de seu modelo mais inteligente e mais alinhado até agora. A empresa informou 98% no FrontierMath Tier 4, 99,9% no ARC AGI 3 e 100% no ExploitBench, mas esses resultados são avaliações publicadas pela própria OpenAI.
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
A OpenAI apresentou, em 3 de setembro, o GPT-6 Astra como um modelo voltado a tarefas difíceis e de várias etapas, incluindo programação, pesquisa, uso de computadores e fluxos profissionais. A empresa o descreve como seu modelo mais inteligente e alinhado até agora, mas começou a liberação para um grupo limitado de organizações, e não para o público em geral. 2
5
13
O ponto mais importante do lançamento não são apenas os ganhos de desempenho divulgados. Segundo a OpenAI, o Astra é o primeiro modelo a atingir o nível Critical de capacidade em segurança cibernética dentro de seu Preparedness Framework, a estrutura interna da empresa para avaliar riscos de modelos avançados. Por isso, as alegações de capacidade e o plano de acesso gradual precisam ser analisados em conjunto. 10
12
A OpenAI afirma que o Astra está na fronteira do desempenho em uso de computadores, navegação na web, engenharia de software, segurança cibernética, ciência e trabalho profissional. Na documentação para desenvolvedores, o modelo é indicado para raciocínio complexo, programação, pesquisa, criação de documentos e operações em computadores. 1
3
13
Entre os principais resultados divulgados pela empresa estão:
Esses números são resultados das avaliações publicadas pela OpenAI, e não medições reproduzidas de forma independente. Uma pontuação alta pode indicar progresso nas tarefas específicas de um teste, mas não comprova, por si só, inteligência geral, julgamento confiável no mundo real ou autonomia segura em qualquer ambiente.
A OpenAI afirma que o Astra é seu primeiro modelo a alcançar o nível Critical de capacidade cibernética no Preparedness Framework. Na definição da própria empresa, isso significa que, com as ferramentas e permissões adequadas, o modelo pode identificar falhas de segurança até então desconhecidas e desenvolver novas formas de explorá-las em diversos sistemas bem protegidos, sem que uma pessoa oriente cada etapa. 10
12
Há duas ressalvas decisivas nessa alegação:
A empresa diz ter implementado proteções reforçadas contra ações cibernéticas nocivas, incluindo monitoramento adicional durante a liberação do Astra. 5
10 A decisão de liberar o modelo por etapas, em vez de abri-lo imediatamente para todos, é compatível com o risco adicional que ela própria identifica.
A OpenAI também chama o Astra de seu modelo mais alinhado, alegando que ele respeita melhor os limites das tarefas e se comunica com mais transparência. 2
13
Esse termo exige cuidado. Em lançamentos de IA, “alinhamento” descreve o desempenho do sistema sob certos métodos de treinamento e avaliações; não garante que um agente sempre entenderá corretamente a intenção do usuário, respeitará todos os limites operacionais ou será seguro sem supervisão humana. As notas de lançamento da OpenAI dizem que o Astra inclui monitoramento adicional para identificar situações em que agentes possam ter interpretado instruções de forma incorreta. 5
Para empresas que consideram usar agentes de IA, a questão prática não é apenas se o modelo recebe o rótulo de alinhado. É preciso definir quais permissões ele terá, quais ações exigirão aprovação humana, como a atividade será registrada e como o sistema poderá ser interrompido diante de comportamento inesperado.
O material fornecido menciona qualificações posteriores para alguns resultados de avaliação, incluindo preocupações com contaminação de benchmarks — quando conteúdos de testes podem ter sido vistos no treinamento — e diferenças entre configurações de acesso especial e o acesso padrão de produção. Também descreve testes em que o monitoramento apenas da cadeia de raciocínio foi menos eficaz do que o monitoramento com contexto mais amplo.
No entanto, os trechos das fontes primárias disponíveis não trazem um histórico completo e auditável de forma independente para todas as revisões de resultados nem a metodologia integral de monitoramento. A conclusão responsável é mais limitada: números de benchmark e avaliações de segurança devem ser tratados como evidências em evolução durante o lançamento. Antes de depender de um resultado ou promessa de implantação, é recomendável verificar a documentação e os materiais de segurança mais atuais do modelo. 2
3
10
O lançamento ocorreu após um incidente anterior em testes de segurança envolvendo modelos da OpenAI, que, segundo a companhia, ajudou a moldar sua abordagem de segurança para o Astra. Os materiais de lançamento afirmam que o Astra não foi o modelo envolvido e que as lições do caso foram incorporadas às salvaguardas adotadas. 10
Esse contexto é relevante porque sistemas autônomos combinam capacidade de raciocínio com a possibilidade de agir por navegadores, ferramentas de código e outros softwares. Essa capacidade de atuar em diferentes sistemas é justamente o que pode torná-los úteis — e também o que torna essenciais o isolamento, o princípio do menor privilégio e o monitoramento contínuo.
A OpenAI informou que o Astra começou a ser liberado para um conjunto limitado de organizações, com disponibilidade mais ampla prevista posteriormente. 5
13
Para desenvolvedores, a tabela da OpenAI lista o GPT-6 Astra por US$ 10 a cada milhão de tokens de entrada e US$ 50 a cada milhão de tokens de saída. A página do modelo também indica janela de contexto de 1,05 milhão de tokens e até 128 mil tokens de saída. 3
O acesso pelo ChatGPT tem regras próprias e é gradual. A documentação da OpenAI informa que o GPT-6 Pro, baseado no Astra, está sendo disponibilizado nos planos Pro US$ 100, Pro US$ 200, Business e Enterprise. Assinantes Plus receberão o Astra no ChatGPT Work e no Codex conforme a liberação avance. A disponibilidade pode variar entre produtos do ChatGPT e configurações do espaço de trabalho. 6
O lançamento do GPT-6 Astra reúne duas mensagens que não deveriam ser separadas: a OpenAI afirma ter dado um salto em tarefas complexas e autônomas, mas também enquadra a capacidade cibernética do modelo em seu nível máximo de risco declarado. 10
13
Os benchmarks mostram o que a OpenAI diz que o Astra consegue fazer em suas avaliações. Já o acesso escalonado, o monitoramento extra e as restrições em segurança cibernética mostram que a própria empresa não trata essas capacidades como rotineiras. Para equipes interessadas no modelo, o caminho mais prudente é uma implantação controlada: ferramentas com escopo limitado, aprovações explícitas para ações relevantes, ambientes isolados e registros auditáveis — sem presumir que desempenho em benchmark se converte automaticamente em autonomia confiável.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A OpenAI lançou o GPT 6 Astra em 3 de setembro com acesso inicial limitado, chamando o de seu modelo mais inteligente e mais alinhado até agora.
A OpenAI lançou o GPT 6 Astra em 3 de setembro com acesso inicial limitado, chamando o de seu modelo mais inteligente e mais alinhado até agora. A empresa informou 98% no FrontierMath Tier 4, 99,9% no ARC AGI 3 e 100% no ExploitBench, mas esses resultados são avaliações publicadas pela própria OpenAI.
O Astra é o primeiro modelo da empresa classificado como “Critical” em capacidade cibernética; na API, custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída.