As fontes públicas não comprovam que o GPT-5.5-Cyber seja um modelo-base totalmente separado, com diferenças de treinamento plenamente divulgadas. A leitura mais segura é tratá-lo como um caminho de acesso limitado e mais permissivo para recursos cyber do GPT-5.5. A Benzinga informou que a prévia não foi pensada para “aumentar significativamente” a capacidade de cibersegurança além do GPT-5.5, mas sim para ser mais permissiva em tarefas relacionadas à segurança, com verificação reforçada e controles de conta para fluxos sensíveis .
Essa nuance importa. Em cibersegurança, uma consulta legítima de defesa pode se parecer, por fora, com uma consulta ofensiva: testar uma falha, validar uma exploração ou analisar um comportamento suspeito. O TechCrunch relatou que o GPT-5.5 Cyber pode executar tarefas como teste de penetração e identificação ou exploração de vulnerabilidades, enquanto a OpenAI limita quem pode usá-lo .
A resposta pública mais clara é: defensores de cibersegurança aprovados. O TechCrunch informou que Sam Altman disse que a OpenAI começaria a liberar o GPT-5.5 Cyber para “defensores cibernéticos críticos” e que havia um processo de candidatura no qual os interessados enviam credenciais e descrevem o uso planejado . A Benzinga também descreveu o lançamento como uma prévia para um número limitado de defensores de cibersegurança, com verificação mais forte e controles de conta para fluxos de trabalho sensíveis .
Na prática, usuários comuns do ChatGPT, desenvolvedores sem credenciamento e empresas fora desse processo não devem presumir que conseguirão simplesmente ativar o recurso. As fontes citadas não trazem regras completas de elegibilidade, prazos de aprovação, lista integral de usuários aprovados, preços ou termos de API.
O Claude Mythos Preview é o concorrente da Anthropic nessa corrida por IA avançada aplicada à defesa cibernética. Relatos descrevem o Mythos como indisponível ao público geral e distribuído por meio do Project Glasswing ou de arranjos fechados com parceiros e listas de permissão para trabalho de segurança defensiva .
O principal marco público do Mythos vem do AISI. Na avaliação do instituto, uma versão inicial do Claude Mythos Preview representou um avanço em relação a modelos de fronteira anteriores e se tornou o primeiro modelo a completar, de ponta a ponta, uma simulação de ataque a rede corporativa — uma tarefa em múltiplas etapas que o AISI estima que levaria cerca de 20 horas para um humano .
Com base no que está disponível publicamente, a comparação prática fica assim:
| Pergunta | GPT-5.5-Cyber | Claude Mythos Preview |
|---|---|---|
| Disponibilidade pública | Prévia limitada; não é um lançamento comum para consumidores . | Restrito ou por lista de permissão; relatos dizem que não há acesso amplo por API pública . |
| Quem recebe acesso | Segundo relatos, “defensores cibernéticos críticos”; candidatos enviam credenciais e uso pretendido . | Relatos apontam acesso via Project Glasswing ou rede de parceiros . |
| Sinal de capacidade | O UK AISI diz que um checkpoint inicial do GPT-5.5 chegou a um nível semelhante ao Mythos em avaliações cyber . | O AISI diz que o Mythos foi o primeiro a completar sua simulação de ataque a rede corporativa de ponta a ponta, com estimativa humana de cerca de 20 horas . |
| Característica do produto | Descrito como mais permissivo para tarefas de segurança, não como grande aumento de capacidade em relação ao GPT-5.5 . | Discutido publicamente sobretudo como capacidade de fronteira restrita para segurança defensiva via parceiros . |
| Principal ressalva | A evidência do AISI trata de capacidade cyber do GPT-5.5, não de um benchmark público completo da versão de produção do GPT-5.5-Cyber . | A maior parte dos terceiros não consegue testá-lo diretamente; comparações dependem de divulgações limitadas e contexto de parceiros . |
Pelo que se sabe publicamente, não há vencedor claro. O Claude Mythos tem o marco histórico mais visível: segundo o AISI, foi o primeiro modelo de fronteira a concluir a simulação de ataque a rede corporativa de ponta a ponta . Mas o mesmo texto do AISI afirma que um checkpoint inicial do GPT-5.5 alcançou desempenho semelhante, sugerindo que a distância entre os laboratórios de ponta está diminuindo rapidamente . A Axios também enquadrou a OpenAI como não muito atrás do Mythos em testes relacionados a hacking .
A OpenAI pode ter uma história de acesso mais acionável para alguns defensores se sua prévia baseada em candidatura se mostrar mais ampla que a rede de parceiros da Anthropic. Ainda assim, as fontes públicas não quantificam quantas equipes realmente receberão acesso ao GPT-5.5-Cyber . Para a maioria dos profissionais, a conclusão é parecida nos dois casos: as capacidades mais sensíveis ficam atrás de uma tela de confiança, parceria ou autorização .
Cibersegurança é um dos exemplos mais claros de uso duplo em IA. O mesmo comportamento de modelo que ajuda um defensor a encontrar e validar uma vulnerabilidade também pode ajudar um atacante. A simulação de ataque a rede corporativa do AISI mostra modelos de fronteira começando a lidar com operações cyber em várias etapas, não apenas com perguntas isoladas . No caso do GPT-5.5 Cyber, o TechCrunch informou que ele pode auxiliar em teste de penetração e identificação ou exploração de vulnerabilidades, o que ajuda a explicar por que o acesso está sendo limitado .
A mudança estratégica é esta: a competição não é só sobre quem tem o modelo mais forte. É também sobre quem consegue entregar capacidades cyber avançadas a defensores sem dar a mesma vantagem a usuários não confiáveis. A resposta da OpenAI, segundo relatos, é acesso verificado por candidatura e controles mais fortes; a da Anthropic, também segundo relatos, é um modelo mais fechado de parceiros e listas de permissão em torno do Mythos .
As dúvidas importam justamente porque os dois sistemas são restritos:
O GPT-5.5-Cyber deve ser lido como o canal controlado da OpenAI para levar capacidades cyber avançadas do GPT-5.5 a defensores verificados. O Claude Mythos Preview é o equivalente da Anthropic, aparentemente ainda mais preso a parceiros e listas de permissão. O resultado do AISI aponta para a questão maior: capacidade cyber avançada em IA já não parece ser uma exceção de um único modelo. Pelo menos dois desenvolvedores de fronteira estão se aproximando de níveis semelhantes — e o controle de acesso virou parte central do produto .