O evento de latência foi noticiado por diversos veículos. O 9to5Mac observou que, por volta das 12h15 (horário de Brasília), um problema separado no FedRAMP também estava sendo monitorado, embora uma correção já tivesse sido aplicada. A latência do ChatGPT foi resolvida primeiro, com o desempenho da API se recuperando totalmente em seguida . O Android Authority confirmou a resolução às 17h28 (horário de Brasília), notando que o incidente havia afetado os usuários ao longo de toda a manhã . A OpenAI não forneceu publicamente uma causa raiz detalhada.
Um incidente separado e mais prolongado começou em 26 de maio, afetando especificamente os usuários autorizados pelo FedRAMP — o programa de nuvem segura do governo dos EUA. Usuários que haviam saído recentemente de suas contas se viram impossibilitados de fazer login novamente no ChatGPT, bloqueando efetivamente o acesso ao serviço .
A interrupção durou aproximadamente 23,2 horas até que a OpenAI aplicasse uma mitigação e começasse a monitorar a recuperação . A própria página de status da OpenAI confirmou a correção e o monitoramento contínuo, enquanto monitores de terceiros, como EagleStatus e Pagerly, listaram o problema de login do FedRAMP como contínuo até 27 de maio . O 9to5Mac relatou posteriormente que o incidente do FedRAMP havia sido removido da página de status após a confirmação total da correção .
A longa duração deste incidente é notável, considerando que o FedRAMP é utilizado por agências governamentais que frequentemente exigem padrões mais altos de confiabilidade.
Além dos dois incidentes de alta visibilidade no final de maio, a OpenAI experimentou pelo menos outras seis interrupções menores ao longo do mês, afetando principalmente as famílias de modelos GPT-5.5 e GPT-5.4, bem como as ferramentas de desenvolvimento do Codex. Todas foram resolvidas e nenhuma foi classificada como uma grande interrupção. A tabela abaixo resume cada evento com base nos dados oficiais da página de status e em rastreadores de incidentes de terceiros.
| Data | Incidente | Duração | Serviços Afetados |
|---|---|---|---|
| 1º de Maio | Taxas elevadas de erro para geração de imagens | ~1,1 horas | ChatGPT, geração de imagens na API |
| 2 de Maio | Taxa de erro elevada na API de Respostas (Responses API) | ~1,2 horas | API de Respostas |
| 8 de Maio | Aumento de erros e latência na API do modelo gpt-5.5 | ~1,8 horas | APIs, Chat, Respostas |
| 11 de Maio | Taxas de erro elevadas com o GPT-5.5 | ~3,2 horas | APIs, Chat, Respostas |
| 15 a 16 de Maio | Degradação de desempenho do GPT-5.5 | ~32 horas | GPT-5.5 para alguns usuários |
| 19 de Maio | Aumento de erros para a API do GPT-5.4 e GPT-5.5 | ~1,1 horas | API, Chat |
| 21 de Maio | Latência e taxas de erro elevadas no ChatGPT 5.5 Thinking | ~8 horas | Modelo ChatGPT 5.5 Thinking |
| 22 de Maio | Pico de usuários atingindo limites de taxa do Codex | ~18,4 horas | Codex, ChatGPT |
Embora cada incidente isoladamente tenha sido pequeno, a concentração de problemas em torno do GPT-5.5, GPT-5.4, ChatGPT 5.5 Thinking e Codex aponta para problemas de adaptação da mais nova geração de modelos da OpenAI . A família GPT-5.5 havia sido totalmente lançada para usuários pagos do ChatGPT apenas no final de abril de 2026, com o acesso à API chegando em 24 de abril .
A degradação de desempenho de 15 a 16 de maio foi o evento individual mais longo, persistindo por cerca de 32 horas e afetando o desempenho do GPT-5.5 sem interromper completamente o serviço . O pico de limite de taxa do Codex em 22 de maio, durando mais de 18 horas, pareceu afetar um número acima do normal de usuários tentando acessar recursos de codificação, indicando potencialmente restrições de capacidade ou problemas de configuração após as recentes atualizações do produto .
A página de status da OpenAI mostra que a camada de API manteve 99,98% de disponibilidade no período de 90 dias encerrado em maio de 2026, com o sistema mais amplo operando a 99,84% . Esses números são consistentes com uma plataforma geralmente saudável, mas que está passando por instabilidades recorrentes e de curta duração em componentes específicos de ponta. Para equipes que dependem dos modelos mais recentes para cargas de trabalho em produção, maio de 2026 serviu como um lembrete de que mesmo incidentes aparentemente pequenos podem atrapalhar os fluxos de trabalho quando surgem em sequência.