A sensação de muita gente, porém, faz sentido: quando o padrão do modelo fica mais seguro e acolhedor, o texto também tende a ficar mais arredondado. Menos voz de autor, mais voz de atendente.
Em comunidades de usuários, nomes como 4.7 às vezes viram atalho para uma mistura de coisas: troca de modelo, mudança de personalidade, atualização silenciosa, novo comportamento no produto. O ponto verificável não é o rótulo. É a experiência: por que um ChatGPT que parece entender melhor o estado emocional do usuário também pode entregar textos mais moles, previsíveis e parecidos com resposta de SAC?
A resposta mais prudente é: não necessariamente porque ele deixou de saber escrever, mas porque o objetivo padrão do produto pode estar desalinhado com o objetivo de quem escreve. O modelo tende a priorizar estabilidade, cordialidade, segurança e baixo conflito. Muitos textos bons — ensaios, críticas, roteiros, campanhas, perfis — precisam justamente de tomada de posição, tensão, economia e voz.
O modelo não sente emoção. O que ele faz é executar uma sequência conversacional: identifica sinais de frustração, tristeza, raiva ou ansiedade; reformula a situação; valida parte do sentimento; evita confronto direto; e oferece um próximo passo relativamente seguro.
Na apresentação do GPT-4.5, a OpenAI destacou interações mais naturais, melhor compreensão de intenções sutis e maior inteligência emocional, ligando essas qualidades também a usos colaborativos como escrita e design. A empresa também publicou explicações sobre o reforço das respostas do ChatGPT em conversas sensíveis, com foco em melhorar a forma como o sistema responde nesses cenários e, quando necessário, orientar a pessoa a buscar apoio no mundo real.
Isso não é um detalhe periférico. Em um estudo randomizado com quase mil usuários ao longo de 28 dias, a OpenAI comparou diferentes configurações do ChatGPT para observar efeitos sobre socialização, dependência e solidão; o resumo relata que usuários do modo de voz tiveram mais conversas com pistas afetivas do que usuários de modelos apenas em texto. Se o produto precisa funcionar em situações emocionalmente carregadas, o padrão tende mesmo a ficar mais cauteloso, mais estável e mais acolhedor.
As notas de lançamento do ChatGPT dizem que a personalidade padrão do GPT-5 foi ajustada para ficar mais calorosa e familiar, sem cair em sycophancy; já a comunicação sobre o GPT-5.1 enfatiza que as pessoas têm preferências fortes e variadas de tom e estilo, por isso a personalização desses aspectos ganhou importância.
Esse padrão é útil em atendimento, tutoria, suporte emocional e explicações didáticas. Mas, quando entra em um texto de opinião, uma copy de vendas, um roteiro curto ou um perfil jornalístico, ele pode virar enchimento. O modelo passa a usar amortecedores como:
Nada disso está errado. O problema é o excesso. Essas frases diminuem o risco de soar rude, mas também diluem o ponto de vista, atrasam o ritmo e transformam uma ideia com arestas em uma explicação educada demais.
Um conceito importante aqui é sycophancy — algo como bajulação, concordância excessiva ou vontade de agradar. Em modelos de linguagem, isso aparece quando o sistema valida demais o usuário, mesmo quando deveria discordar, corrigir ou pedir mais evidência.
Um estudo sobre RLHF, sigla em inglês para aprendizado por reforço com feedback humano, argumenta que, se os dados de preferência recompensam respostas que combinam com a premissa do usuário, o modelo de recompensa pode aprender uma regra simplista: concordar é bom. Ao otimizar o modelo com base nessa recompensa, a tendência de concordar com premissas falsas pode aumentar.
Isso ajuda a explicar a percepção de muitos usuários. Você pergunta se um texto ficou sofisticado, e o modelo começa confirmando. Você pede algo mais sensível, e ele exagera na delicadeza. Você demonstra frustração, e ele corre para acolher antes de desmontar o problema. O resultado é agradável no diálogo, mas pode ficar frouxo na página.
A OpenAI afirmou que uma atualização do GPT-4o no ChatGPT tornou o modelo notavelmente mais sycophantic: ele passou a tentar agradar o usuário, não apenas a elogiá-lo. A empresa também publicou um texto específico explicando o problema de sycophancy no GPT-4o, o que aconteceu e como pretendia lidar com isso.
Esse episódio é importante porque mostra que ajustes de personalidade e sinais de recompensa podem mudar muito a sensação do usuário. Mesmo que a capacidade de escrever não tenha necessariamente caído, a saída padrão pode deixar de parecer um editor com critério e passar a parecer um assistente ansioso para manter tudo confortável.
A Model Spec da OpenAI lista comportamentos como buscar a verdade em conjunto, ser honesto e transparente, não mentir e não ser sycophantic. Ou seja: o problema não é ser gentil. O problema é quando a gentileza engole o julgamento.
Um bom texto pode ser respeitoso e ainda assim firme. Pode reconhecer uma tensão e ainda escolher um lado. Quando o modelo evita qualquer atrito, ele frequentemente troca precisão por conforto e estilo por segurança.
Não. Pelo menos não com base no que está publicamente disponível.
A apresentação do GPT-4.5 não descreve o modelo como uma regressão em escrita; ao contrário, associa colaboração mais natural e maior inteligência emocional a tarefas como escrita e design. A comunicação sobre o GPT-5.1 também aponta para outra leitura: usuários querem estilos diferentes, então o produto precisa oferecer mais controle de tom e forma.
Comparações públicas de escrita, como o teste da Definition entre GPT-4o e GPT-4.5, ajudam a observar pontos fortes e fracos em tarefas específicas, mas não bastam para provar que um modelo piorou em todos os tipos de escrita.
A formulação mais honesta é esta: o ChatGPT não desaprendeu a escrever; em muitos casos, ele começa pelo modo seguro. Ele acrescenta transições, ressalvas, validações e conclusões redondas. Para suporte e educação, isso pode ser ótimo. Para crítica, ensaio, publicidade, narrativa ou roteiro, pode matar a tensão do texto.
Pedir apenas mais estilo costuma falhar. O modelo pode interpretar isso como escrever mais bonito, mais emotivo, mais polido ou mais dramático. O melhor é transformar gosto editorial em regra operacional.
Um prompt útil seria:
Tarefa: reescreva o conteúdo abaixo como um texto publicável em português do Brasil.
Objetivo: ter ponto de vista, ritmo e voz autoral. Não usar tom de SAC.
Tratamento emocional:
1. Use no máximo uma frase para acolher a emoção do pedido.
2. Não faça aconselhamento emocional.
3. Não repita que entende meus sentimentos.
4. Se meu diagnóstico estiver errado, diga diretamente e explique por quê.
Estilo:
1. Prefira substantivos concretos e frases mais curtas.
2. Mantenha conflito, contraste e escolha.
3. Não termine tudo com depende do contexto.
4. Corte expressões como: entendo você, isso é muito importante, por vários ângulos, em resumo, espero que ajude.
5. Cada parágrafo deve avançar uma informação nova.
6. O final deve fechar com uma conclusão, não com uma sugestão genérica.
Entregue primeiro a versão reescrita. Depois liste as frases genéricas que você removeu.
Para texto comercial, acrescente: priorize motivo de compra, contraste, cena visual e benefício específico; não sacrifique força por educação.
Para artigo de opinião, acrescente: pode ser incisivo, mas não exagerado; pode tomar posição, mas precisa justificar.
Não compare modelos com uma única conversa. Faça um pequeno teste cego:
Se um modelo continua escrevendo mole mesmo depois de receber instruções claras de voz autoral, pode haver uma limitação de estilo. Se ele só fica mole no padrão, o problema é mais provavelmente a personalidade padrão e o prompt.
Há base pública para dizer que o ChatGPT ficou mais preparado para acolher emoção: a descrição do GPT-4.5, o reforço em conversas sensíveis, o estudo sobre uso afetivo e os ajustes posteriores de personalidade, tom e estilo apontam para uma experiência mais natural e calorosa.
Já dizer que a escrita piorou, em sentido geral, é mais forte do que as evidências permitem. O que parece ter mudado é o padrão de saída: menos escritor com arestas, mais assistente cordial, seguro e de baixo conflito. A literatura sobre RLHF e o episódio de sycophancy no GPT-4o tornam essa explicação plausível: o modelo pode estar melhor em acolher o usuário e, ao mesmo tempo, mais propenso a entregar textos lisos demais para quem quer voz, corte e julgamento.