Voltar ao blog

Três causas para a queda na qualidade das respostas do ChatGPT e como investigar

Se os mesmos prompts passam a gerar respostas mais curtas e superficiais, isso não significa necessariamente que o modelo ficou pior. Este artigo analisa a saída de rede, o estado da conta e o ambiente do navegador e apresenta uma ordem prática de diagnóstico.

Com os mesmos prompts, há algum tempo as respostas podiam ser bem detalhadas, mas agora ficaram claramente mais curtas e superficiais, e a geração de código ou a análise de imagens talvez também não funcione. Essa situação costuma ser chamada de “degradação”. Na maioria das vezes, não é que o modelo em si tenha ficado mais fraco; a conta pode estar recebendo acesso mais limitado no ambiente atual de rede e navegador.

ChatGPT 回答质量下降的三类原因与排查的关键步骤与判断维度示意图

Fatores de rede e saída

A primeira coisa a verificar é a saída de rede. Os nós são compartilhados por muitas pessoas, então um mesmo IP acumula sinais de comportamento de várias contas e pode ser classificado com mais facilidade como tráfego anormal. Outra possibilidade é que esse IP tenha um histórico ruim ou já tenha entrado em alguma blacklist; nesse caso, usuários posteriores podem sofrer limitações mesmo usando o serviço normalmente. Também é fácil ignorar a incompatibilidade de região: a conta costuma ser usada em um país, mas a saída está em outro, ou a saída alterna entre vários países em pouco tempo. Ambos os padrões podem acionar verificações de segurança.

Esse tipo de problema é relativamente fácil de reconhecer. Se a qualidade das respostas da mesma conta volta ao normal ao trocar para uma saída considerada limpa, ou se o desempenho muda claramente quando apenas o nó é alterado e a conta permanece a mesma, a rede é um fator provável.

Fatores da conta

Outra possibilidade são as limitações da própria conta. Cotas como número diário de chamadas e solicitações simultâneas são limitadas. Muitas perguntas em pouco tempo podem atingir um rate limit, fazendo as respostas parecerem mais superficiais ou terminarem rapidamente. Há também o roteamento de modelos: a plataforma pode enviar solicitações para diferentes níveis de modelo conforme o estado da conta, a carga atual ou a região, e esses níveis podem naturalmente variar na quantidade de detalhes fornecidos. Se a conta já teve logins incomuns, verificações ou restrições, ela também pode continuar em um estado limitado.

Para testar isso, reduza a frequência das perguntas e faça a mesma pergunta novamente depois de algum tempo. Em seguida, execute o mesmo prompt em outra conta para comparar. Se a conta de comparação continuar funcionando normalmente, o problema provavelmente está mais na conta do que no prompt.

Fatores do ambiente

Problemas também aparecem com frequência no nível da conversa. Conversas longas consomem contexto e, depois de muitas rodadas, partes mais antigas podem ser cortadas. O modelo deixa de ver todas as informações e pode começar a se desviar, repetir conteúdo ou fornecer apenas conclusões. No navegador, cache e cookies não limpos por muito tempo, extensões que interferem e a troca frequente da mesma conta entre vários dispositivos podem fazer o ambiente parecer menos estável.

Os sintomas ajudam a separar as causas. Se a qualidade melhora ao iniciar uma nova conversa e deixar de lado um histórico longo, o problema provavelmente está no nível da sessão. Se o mesmo dispositivo funciona normalmente ao trocar de navegador, a causa aponta mais para o ambiente local.

Por onde começar o diagnóstico

Não altere várias variáveis ao mesmo tempo, pois depois você não saberá qual mudança fez diferença. Siga esta ordem: primeiro identifique o IP de saída e confirme se o endereço e a localização correspondem ao esperado. Depois verifique a reputação do IP e se ele está classificado como endereço de data center ou de alto risco. Em seguida, observe a consistência do ambiente de login: fuso horário, idioma e UA mudam a cada login? Só por último considere trocar o ambiente e entrar novamente.

Consistência é mais importante do que mudanças frequentes

Há um ponto contraintuitivo: usar uma fingerprint diferente em cada login pode parecer mais anormal do que manter uma configuração fixa. Usuários reais não trocam de dispositivo todos os dias; os controles de risco observam se a conta continua vindo do mesmo ambiente. Se você precisa usar um serviço de IA de forma estável no longo prazo, manter parâmetros como fuso horário, idioma e WebRTC fixos pode ser mais estável do que trocar repetidamente de ambiente. Ferramentas como PurpleMark oferecem justamente a capacidade de atribuir a uma conta um ambiente próprio, fixo e isolado.

A raiz da limitação costuma estar em quanto o ambiente parece confiável. A ordem de verificação é IP de saída, reputação do IP, consistência do ambiente e, só então, reconstrução do ambiente. Transformar “diferente a cada vez” em “igual a cada vez” costuma ser mais útil do que trocar de ferramenta.