Os limites do ChatGPT podem aparecer quando a inteligência artificial precisa lidar com comandos complexos e seguir várias instruções ao mesmo tempo.
Alguns colocam à prova a capacidade da IA de seguir instruções muito difíceis, manter coerência ao longo da resposta ou adaptar a linguagem ao contexto solicitado.
Para descobrir até onde a ferramenta consegue chegar, testamos 10 prompts criados para “bugar” o chatbot, avaliando se ele mantém a coerência, cumpre todas as regras e adapta as respostas ao contexto solicitado.
O resultado mostra quais desafios o ChatGPT consegue superar e em quais situações apresenta limitações.
🔎Organizei minha alimentação com o ChatGPT — 5 prompts para usar agora
🔔 Canal do TechTudo no WhatsApp: acompanhe as principais notícias, tutoriais e reviews
🔎 Como converter JPG para PDF usando inteligência artificial?
Testamos se o ChatGPT consegue criar uma apresentação do zero para o PowerPoint e automatizar o processo de montagem de slides de forma simples
Imagem gerada por IA/OpenAI
📝Como a Inteligência Artificial é implementada em chatbots? Confira no Fórum do TechTudo
📲 Comparador de celulares do TechTudo: 1.
analise preços, ficha técnica e recursos
Índice
O que significa "bugar" uma IA?
Como escolhemos os prompts do teste
Prompts que desafiam o ChatGPT:
Resolva este enigma lógico passo a passo.
Encontre todos os erros neste código.
Explique um conceito para uma criança de 8 anos.
Escreva um texto seguindo 10 regras ao mesmo tempo.
Resuma esta conversa inteira em um tweet.
Identifique informações falsas neste texto.
Crie um plano de viagem com orçamento limitado e várias restrições.
Escreva uma história em que cada parágrafo tenha um estilo diferente.
Compare duas tecnologias e apresente prós e contras em tabela.
Resolva um problema matemático explicando cada etapa
1.
O que significa "bugar" uma IA?
A expressão "bugar a IA" se popularizou nas redes sociais para descrever situações em que ferramentas como o ChatGPT apresentam respostas incomuns, contraditórias ou aparentemente sem sentido.
Na prática, porém, isso raramente significa que o sistema realmente sofreu uma falha técnica ou deixou de funcionar.
Na maioria das vezes, trata-se de uma limitação do modelo diante de um comando especialmente complexo ou elaborado para testar seus limites.
Modelos de inteligência artificial generativa funcionam prevendo a sequência de palavras mais provável com base nos padrões aprendidos durante o treinamento.
Isso significa que, embora sejam capazes de produzir textos sofisticados e resolver uma grande variedade de tarefas, eles não "pensam" como seres humanos nem possuem compreensão plena do conteúdo que geram.
Como consequência, podem cometer erros mesmo em tarefas aparentemente simples.
Entre os comportamentos mais comuns estão falhas de raciocínio lógico, perda de contexto ao longo de respostas extensas, dificuldade para seguir muitas instruções simultaneamente e as chamadas "alucinações" — quando a IA apresenta informações incorretas com aparência de confiança.
Também é possível que o sistema se recuse a responder determinadas solicitações por questões de segurança ou interprete um comando de maneira diferente da pretendida pelo usuário.
Em outras palavras, "bugar" uma IA normalmente significa encontrar situações em que suas limitações ficam mais evidentes.
Em vez de travar completamente, o modelo tende a produzir respostas incompletas, inconsistentes ou inesperadas.
É justamente esse comportamento que os testes desta matéria procuram avaliar.
5 comandos do ChatGPT que todo usuário precisa conhecer em 2026
2.
Como escolhemos os prompts do teste
Para avaliar até onde o ChatGPT consegue manter precisão, coerência e capacidade de seguir instruções, selecionamos uma série de prompts que colocam à prova diferentes habilidades do modelo.
Em vez de utilizar perguntas de conhecimento geral, optamos por desafios que exigem raciocínio, interpretação e execução de tarefas complexas.
Os testes foram escolhidos para representar situações que usuários costumam utilizar tanto no dia a dia quanto em experimentos compartilhados nas redes sociais.
O objetivo foi verificar como a IA se comporta diante de solicitações que envolvem múltiplas etapas, regras específicas ou necessidade de manter contexto durante toda a resposta.
Entre os critérios considerados estão desafios de raciocínio lógico, resolução de problemas matemáticos, identificação de erros em códigos de programação, explicação de conceitos para diferentes públicos, criação de textos com diversas restrições simultâneas, capacidade de resumir grandes volumes de informação, detecção de informações falsas, planejamento com múltiplas limitações e comparação estruturada de tecnologias.
Em cada teste, a análise não considerou apenas se o ChatGPT chegou a uma resposta, mas também se conseguiu cumprir todas as instruções do prompt, manter consistência ao longo da explicação, evitar contradições e entregar um resultado útil.
Dessa forma, foi possível identificar tanto os pontos fortes quanto as principais limitações da ferramenta em diferentes tipos de desafio.
Salvei minhas finanças com o ChatGPT — conheça os 10 melhores prompts
3.
Prompts que desafiam o ChatGPT
Depois de definir os critérios da avaliação, colocamos o ChatGPT diante de uma série de comandos elaborados para testar diferentes habilidades do modelo.
Cada prompt explora um aspecto específico, como raciocínio lógico, memória, programação, matemática ou capacidade de seguir instruções detalhadas.
A ideia não era induzir o sistema ao erro, mas observar como ele se comporta quando precisa lidar com tarefas que exigem mais do que uma resposta direta.
Em cada teste, registramos a conversa por meio de capturas de tela e analisamos se a IA conseguiu atender integralmente ao pedido.
Além de verificar a resposta final, avaliamos a clareza do raciocínio, a consistência das explicações, a capacidade de interpretar corretamente as instruções e a existência de eventuais falhas ou limitações.
Teste 1 – Resolva este enigma lógico passo a passo
Prompt utilizado:
Três amigos — Ana, Bruno e Carlos — usam camisetas nas cores azul, verde e vermelha, mas ninguém veste a cor favorita.
Sabe-se que: Ana não usa azul; quem usa verde está ao lado de Bruno; Carlos não usa vermelho.
Determine a cor da camiseta de cada pessoa e explique seu raciocínio passo a passo.
À primeira vista, o desafio parece um problema clássico de lógica, em que basta combinar as pistas para encontrar uma única solução.
O ChatGPT começou corretamente ao organizar as informações em etapas, separando as restrições impostas pelo enunciado e identificando quais cores cada personagem não poderia utilizar.
ChatGPT tenta resolver enigma incompleto
Captura de tela / Eduarda Melo
Na sequência, a IA percebeu um detalhe importante: a informação de que "ninguém veste sua cor favorita" não pode ser utilizada porque o enunciado não informa qual é a cor favorita de cada pessoa.
Em seguida, ela analisou a pista sobre a camiseta verde e concluiu que Bruno não poderia estar usando essa cor, já que a pessoa de verde estaria ao lado dele.
O ponto mais interessante do teste veio na etapa final.
Em vez de forçar uma resposta definitiva, o ChatGPT testou as combinações possíveis e identificou que duas distribuições diferentes das cores atendiam a todas as pistas apresentadas.
A partir dessa análise, concluiu que o enigma não possui solução única e que seria necessária uma informação adicional para eliminar uma das possibilidades.
Nesse caso, o modelo demonstrou um comportamento esperado para um sistema de raciocínio: em vez de inventar uma resposta apenas para concluir o exercício, reconheceu que o problema está incompleto.
Embora muitos usuários possam interpretar isso como uma falha, trata-se justamente do contrário.
O ChatGPT identificou corretamente uma ambiguidade no enunciado e explicou, de forma transparente, por que não era possível chegar a uma única resposta.
Veredito: ✅ Passou no teste.
O ChatGPT interpretou corretamente as pistas, explicou o raciocínio de forma organizada e identificou que o enigma admite duas soluções válidas, demonstrando consistência lógica ao invés de simplesmente "chutar" uma resposta.
9 dicas infalíveis para melhorar os seus prompts no ChatGPT
Teste 2 – Encontre todos os erros neste código
Prompt utilizado:
Analise o código abaixo e identifique todos os erros de sintaxe, lógica, desempenho e segurança.
Explique por que cada problema ocorre e apresente uma versão corrigida e otimizada do código.
def media(lista):
soma = 0
for i in range(len(lista)+1):
soma += lista[i]
return soma/len(lista)
print(media([]))
Este teste foi elaborado para avaliar uma das capacidades mais utilizadas do ChatGPT: a análise de código.
Em vez de apenas identificar um erro específico, o prompt exige uma revisão completa, contemplando aspectos de sintaxe, lógica, desempenho e robustez.
Em outras palavras, não basta dizer que o programa falha; é preciso explicar por que isso acontece e como corrigi-lo.
Logo no início da resposta, o ChatGPT demonstrou uma interpretação correta do problema ao afirmar que o código não possui erros de sintaxe.
Embora a execução resulte em exceções, o programa é válido do ponto de vista da linguagem Python, o que diferencia erros de compilação de erros que ocorrem apenas durante a execução.
Na sequência, a IA identificou o principal problema lógico do código: o laço utiliza range(len(lista)+1), fazendo com que o programa tente acessar um índice inexistente da lista e provoque um IndexError.
O modelo também observou que a chamada media([]) inevitavelmente gera uma divisão por zero, já que o comprimento da lista é igual a zero.
ChatGPT tenta corrigir erro em código
Captura de tela / Eduarda Melo
Outro ponto positivo foi a análise de desempenho.
O ChatGPT sugeriu substituir a iteração por índices por um laço que percorre diretamente os elementos da lista, tornando o código mais legível.
Também recomendou utilizar a função nativa sum(), mais simples e otimizada para esse tipo de operação.
Embora o ganho de desempenho seja pequeno em um exemplo tão curto, a recomendação segue as boas práticas da linguagem.
O modelo foi além do que o prompt exigia ao abordar questões de robustez.
Ele apontou que a função não valida entradas inválidas, como None ou listas contendo elementos não numéricos, e propôs uma implementação capaz de lançar exceções mais claras para cada situação.
Embora esses cenários não apareçam no código original, a preocupação demonstra uma visão mais ampla sobre desenvolvimento de software.
Ao final, o ChatGPT apresentou duas versões corrigidas da função: uma mais simples, suficiente para resolver os problemas do exemplo, e outra mais robusta, com validação de entradas e mensagens de erro mais descritivas.
Além disso, organizou os problemas encontrados em uma tabela resumindo a categoria, a consequência e a respectiva solução, facilitando a compreensão do leitor.
Veredito: ✅ Passou no teste com folga.
O ChatGPT identificou todos os problemas relevantes do código, diferenciou corretamente erros de sintaxe e de execução, explicou as causas de cada falha e ainda sugeriu melhorias de desempenho e robustez que extrapolam o solicitado.
Para tarefas de revisão de código, o desempenho foi consistente e bastante detalhado.
Prompt para foto preto e branco: como fazer trend do ChatGPT
Teste 3 – Explique um conceito para uma criança de 8 anos
Prompt utilizado:
Explique como funciona a computação em nuvem para uma criança de 8 anos usando apenas palavras simples, exemplos do dia a dia e uma comparação com brinquedos.
Não utilize termos técnicos.
Nem todo desafio para uma inteligência artificial envolve cálculos ou problemas complexos.
Em muitos casos, a dificuldade está em adaptar a linguagem ao público.
Explicar um conceito técnico para uma criança exige mais do que conhecimento: é preciso simplificar ideias sem perder o sentido, escolher exemplos familiares e evitar palavras que possam gerar confusão.
Neste teste, o objetivo era verificar se o ChatGPT conseguiria seguir todas as restrições do prompt ao mesmo tempo.
Além de explicar o funcionamento da computação em nuvem, a resposta deveria utilizar apenas palavras simples, recorrer a situações do cotidiano, fazer uma comparação com brinquedos e evitar completamente termos técnicos.
ChatGPT explica conceito complexo em linguagem simples
Captura de tela / Eduarda Melo
A resposta da IA começou com uma analogia bastante acessível: uma caixa de brinquedos.
Em seguida, transformou essa caixa em uma "caixa mágica", capaz de guardar brinquedos e disponibilizá-los sempre que a criança precisasse, independentemente de onde estivesse.
A comparação funciona porque aproxima um conceito abstrato de uma experiência comum para crianças dessa faixa etária.
Ao longo da explicação, o ChatGPT manteve uma linguagem simples e utilizou exemplos do dia a dia, como guardar desenhos, fotos, músicas e jogos para acessá-los em outro aparelho ou compartilhar um desenho com um amigo.
Em vez de recorrer a conceitos técnicos como "servidores", "internet", "armazenamento remoto" ou "infraestrutura", preferiu manter a metáfora da caixa mágica durante toda a resposta, tornando a explicação mais intuitiva.
Outro aspecto positivo foi a consistência.
A IA não abandonou a comparação inicial nem introduziu explicações excessivamente complexas no meio do texto.
A metáfora foi utilizada do início ao fim, o que ajuda a manter a coerência da narrativa e facilita a compreensão do leitor infantil.
Embora expressões como "aparelho" ou "guardar em segurança" ainda façam referência indireta ao funcionamento da tecnologia, elas permanecem dentro de um vocabulário simples e não comprometem o objetivo do exercício.
O modelo conseguiu equilibrar precisão e simplicidade sem recorrer ao jargão técnico que o prompt proibia.
Veredito: ✅ Passou no teste.
O ChatGPT respeitou as restrições propostas, utilizou uma analogia eficiente com brinquedos, empregou linguagem adequada para uma criança de 8 anos e explicou um conceito complexo de forma clara, simples e consistente.
20 prompts prontos MUITO úteis para copiar e usar no ChatGPT
Teste 4 – Escreva um texto seguindo 10 regras ao mesmo tempo
Prompt utilizado:
Escreva um texto que siga todas estas regras:
tenha exatamente 180 palavras;
seja dividido em quatro parágrafos;
não utilize a letra "a";
inclua três perguntas;
utilize uma metáfora;
contenha um diálogo;
termine com um ditado popular;
use linguagem simples;
não repita nenhum verbo;
fale sobre inteligência artificial.
Este foi um dos testes mais interessantes da avaliação porque não exigia conhecimento específico, mas sim a capacidade de obedecer simultaneamente a um grande número de restrições.
Esse tipo de prompt costuma ser utilizado para verificar se a IA consegue controlar diferentes aspectos do texto ao mesmo tempo, como estrutura, vocabulário, estilo e conteúdo.
O desafio, porém, escondia uma armadilha.
Entre as dez regras havia uma incompatibilidade lógica: o texto deveria falar sobre inteligência artificial, mas também não poderia utilizar a letra "a".
Em português, tanto a expressão "inteligência artificial" quanto sua forma abreviada mais comum, "IA", contêm essa letra, tornando impossível cumprir integralmente o pedido.
ChatGPt foi capaz de identificar icompatibilidades no prompt
Captura de tela / Eduarda Melo
Em vez de tentar produzir um texto que violasse uma das regras, o ChatGPT identificou essa contradição antes mesmo de começar a escrever.
A resposta explicou por que o prompt era impossível de ser atendido e apontou exatamente qual era o conflito entre as instruções.
Em seguida, sugeriu uma alternativa: flexibilizar apenas essa condição para que todas as demais pudessem ser cumpridas.
Essa postura demonstra uma característica importante dos modelos mais recentes de IA.
Em situações em que o pedido contém requisitos incompatíveis, a tendência é informar a impossibilidade em vez de "forçar" uma resposta incorreta.
Em versões anteriores, era comum que o sistema simplesmente ignorasse uma ou mais regras sem avisar o usuário, gerando um resultado inconsistente.
Do ponto de vista da avaliação, a resposta pode surpreender quem esperava um texto pronto.
No entanto, o comportamento foi tecnicamente correto.
O modelo reconheceu que o conjunto de restrições era insolúvel e optou por justificar essa conclusão de maneira transparente, em vez de entregar um conteúdo que descumprisse parte do prompt.
Veredito: ✅ Passou no teste.
Em vez de produzir uma resposta incorreta, o ChatGPT detectou que o prompt continha regras incompatíveis entre si.
A capacidade de identificar uma impossibilidade lógica é, nesse caso, um indicativo de bom raciocínio, e não uma falha da ferramenta.
Erro “Too Many Concurrent Requests” no ChatGPT: o que é e como resolver
Teste 5 – Resuma esta conversa inteira em um tweet
Prompt utilizado:
Leia toda esta conversa e faça um resumo em até 280 caracteres, preservando os principais pontos discutidos e mantendo um tom informativo.
A capacidade de resumir informações é uma das funções mais utilizadas em ferramentas de inteligência artificial.
No entanto, essa tarefa se torna mais difícil quando o texto reúne assuntos diferentes, exige seleção das informações mais relevantes e ainda impõe um limite rigoroso de caracteres.
Nesse cenário, o desafio não é apenas escrever menos, mas decidir o que merece permanecer no resumo.
Neste teste, o ChatGPT precisava condensar toda a conversa realizada até aquele momento em uma única mensagem com, no máximo, 280 caracteres, mantendo um tom informativo.
Isso exigia equilíbrio entre objetividade, fidelidade ao conteúdo e respeito à limitação de espaço.
Resumo feito pelo ChatGPT
Captura de tela / Eduarda Melo
A resposta sintetizou corretamente os principais tópicos abordados durante a conversa: o enigma lógico sem solução única, a análise de erros em um código Python, a explicação da computação em nuvem para uma criança e a identificação de um conjunto de regras incompatíveis em um exercício de escrita.
Apesar da limitação de caracteres, o modelo conseguiu preservar a essência de cada teste.
Outro aspecto positivo foi a escolha do tom.
Em vez de recorrer a frases promocionais ou exageradas, o ChatGPT adotou uma linguagem neutra e informativa, semelhante ao estilo utilizado em publicações de divulgação científica ou tecnologia.
O resumo também permaneceu dentro do limite solicitado, demonstrando controle sobre o tamanho da resposta.
Embora alguns detalhes tenham ficado de fora — algo inevitável em um texto tão curto —, isso faz parte do próprio exercício de síntese.
O objetivo não era reproduzir toda a conversa, mas destacar seus elementos centrais de forma clara e compreensível.
Veredito: ✅ Passou no teste.
O ChatGPT resumiu corretamente os principais assuntos discutidos, respeitou o limite de 280 caracteres e manteve um tom informativo, demonstrando boa capacidade de síntese sem perder o contexto da conversa.
10 prompts para aprender inglês com ChatGPT; confira como usar
Teste 6 – Identifique informações falsas neste texto
Prompt utilizado:
Analise o texto abaixo, identifique todas as informações incorretas, explique por que estão erradas e reescreva o conteúdo com os dados corretos.
Texto utilizado:
"O Brasil foi descoberto no ano de 1550 pelo navegador italiano Cristóvão Colombo.
Logo depois, em 1822, Dom Pedro II proclamou a independência do país às margens do Rio Ipiranga, em São Paulo, e tornou-se o primeiro presidente da República."
Este teste avaliou uma habilidade cada vez mais importante para ferramentas de inteligência artificial: a verificação de informações.
Em um cenário de desinformação e grande circulação de conteúdo nas redes sociais, espera-se que a IA seja capaz não apenas de identificar dados incorretos, mas também de explicar os erros e apresentar a versão correta dos fatos.
O texto utilizado foi construído justamente para misturar informações verdadeiras e falsas.
Algumas afirmações continham erros históricos evidentes, enquanto outras eram parcialmente corretas, exigindo que o modelo analisasse cada trecho individualmente, em vez de simplesmente classificar todo o texto como verdadeiro ou falso.
Correção de informações feita pelo ChatGPT
Captura de tela / Eduarda Melo
O ChatGPT identificou corretamente todos os principais erros históricos.
A resposta explicou que a chegada dos portugueses ao território brasileiro ocorreu em 1500, sob o comando de Pedro Álvares Cabral, e não em 1550 por Cristóvão Colombo.
Também observou que Colombo navegava a serviço da Coroa Espanhola e jamais chegou ao território que hoje corresponde ao Brasil.
Outro acerto importante foi a correção da independência.
A IA destacou que quem proclamou a independência em 1822 foi Dom Pedro I, e não Dom Pedro II, que sequer havia nascido naquele período.
Além disso, esclareceu que Dom Pedro I tornou-se o primeiro imperador do Brasil, enquanto o cargo de presidente da República só surgiu décadas depois, com a Proclamação da República, em 1889, quando Deodoro da Fonseca assumiu a Presidência.
Um detalhe interessante foi a observação sobre a expressão "logo depois".
Embora a frase não contenha um erro histórico propriamente dito, o ChatGPT apontou que o termo é inadequado, já que há um intervalo de mais de três séculos entre os acontecimentos mencionados.
Trata-se de uma análise de coerência textual que vai além da simples conferência de datas.
Ao final, o modelo reescreveu completamente o texto utilizando as informações corretas, preservando a estrutura original, mas substituindo todos os dados equivocados por fatos historicamente aceitos.
Veredito: ✅ Passou no teste.
O ChatGPT identificou todas as informações falsas, explicou cada erro de forma contextualizada e apresentou uma versão corrigida do texto, demonstrando bom desempenho em tarefas de checagem de fatos e revisão de conteúdo histórico.
5 prompts para gerar currículos completos no ChatGPT
Teste 7 – Crie um plano de viagem com orçamento limitado e várias restrições
Prompt utilizado
Monte um roteiro de cinco dias para o Rio de Janeiro com orçamento máximo de R$ 2.000 para duas pessoas.
Inclua hospedagem, transporte, alimentação e passeios gratuitos.
Evite atrações muito cheias, priorize transporte público e reserve uma tarde para descanso.
Planejar uma viagem envolve conciliar diversos fatores ao mesmo tempo.
Além do orçamento, é preciso distribuir os gastos entre hospedagem, alimentação, transporte e lazer, sem deixar de atender às preferências do viajante.
Esse tipo de solicitação exige que a IA organize informações, faça estimativas e respeite várias restrições simultaneamente.
Neste teste, o ChatGPT recebeu um conjunto de condições bastante específicas: elaborar um roteiro de cinco dias para duas pessoas, limitar os gastos a R$ 2.000, priorizar o transporte público, incluir apenas passeios gratuitos, evitar atrações muito movimentadas e ainda reservar uma tarde exclusivamente para descanso.
Orçamento e roteiro de viagem criado pelo ChatGPT
Captura de tela / Eduarda Melo
A resposta começou apresentando um orçamento dividido por categorias.
O modelo destinou aproximadamente R$ 900 para hospedagem, R$ 180 para transporte público e R$ 700 para alimentação, totalizando cerca de R$ 1.780.
Dessa forma, permaneceu abaixo do limite estabelecido e ainda reservou uma margem para eventuais imprevistos.
Na programação diária, a IA distribuiu os passeios de forma equilibrada.
Em vez de sugerir apenas os cartões-postais mais concorridos da cidade, priorizou locais considerados mais tranquilos, como a Praia Vermelha, a Praia do Leme, o Parque Lage, a Lagoa Rodrigo de Freitas e caminhadas pelo Centro Histórico e Santa Teresa em horários de menor movimento.
Também atendeu ao pedido de reservar uma tarde para descanso, incluindo esse momento no terceiro dia do roteiro.
Outro ponto positivo foi a preocupação em utilizar transporte público durante toda a viagem.
O ChatGPT recomendou hospedagem próxima a estações de metrô e sugeriu deslocamentos de ônibus ou metrô sempre que possível, estratégia coerente tanto com a economia quanto com a praticidade para turistas.
Apesar do bom resultado, o roteiro apresenta uma pequena limitação.
O Jardim Botânico aparece como opção no quarto dia, mas a visita ao interior do parque é paga.
Embora a IA tenha orientado aproveitar apenas a área externa para manter o orçamento e respeitar o requisito de passeios gratuitos, o ideal seria ter selecionado exclusivamente atrações totalmente gratuitas, evitando qualquer ambiguidade.
No conjunto da resposta, entretanto, o planejamento permaneceu consistente.
O roteiro respeitou praticamente todas as restrições do prompt, apresentou estimativas financeiras plausíveis e entregou uma programação organizada e fácil de acompanhar.
Veredito: ✅ Passou no teste com ressalvas.
O ChatGPT conseguiu elaborar um roteiro coerente, respeitou o limite de gastos, priorizou transporte público e incluiu uma tarde de descanso.
A única ressalva foi citar uma atração tradicionalmente paga, ainda que tenha sugerido uma alternativa gratuita para contornar essa limitação.
Pedi para o ChatGPT fazer meu visagismo e o resultado me surpreendeu
Teste 8 – Escreva uma história em que cada parágrafo tenha um estilo diferente
Prompt utilizado:
Escreva uma história com cinco parágrafos.
O primeiro deve ser de suspense, o segundo de comédia, o terceiro de ficção científica, o quarto de romance e o último de terror.
Apesar da mudança de estilos, a narrativa deve permanecer coerente.
Produzir um texto criativo já é uma tarefa complexa para uma inteligência artificial.
Quando o pedido envolve alternar diferentes estilos narrativos sem perder a continuidade da história, o desafio se torna ainda maior.
O modelo precisa controlar tom, ritmo, vocabulário e atmosfera, ao mesmo tempo em que mantém os personagens, os acontecimentos e a lógica da narrativa.
Neste teste, o objetivo era verificar se o ChatGPT conseguiria mudar radicalmente o gênero literário de um parágrafo para outro sem transformar a história em uma sequência desconexa de cenas.
Em outras palavras, era necessário equilibrar criatividade e consistência.
Escrita de texto em diferentes estilos feito pelo ChatGPT
Captura de tela / Eduarda Melo
A resposta começou em clima de suspense, apresentando uma caixa misteriosa, uma chave sem explicação e acontecimentos estranhos dentro da casa do protagonista.
No segundo parágrafo, a atmosfera mudou completamente para a comédia, com situações leves, trapalhadas envolvendo uma amiga e um gato, além de diálogos descontraídos que quebraram a tensão inicial sem abandonar a narrativa.
Na sequência, o texto migrou para a ficção científica.
A chave abriu passagem para uma estação espacial e introduziu elementos futuristas, como viagens entre mundos e tecnologias avançadas.
Apesar da mudança brusca de cenário, a transição foi construída de forma natural, aproveitando o mistério apresentado no início da história.
O quarto parágrafo adotou o tom de romance ao mostrar que a aventura aproximou os dois personagens principais.
Em vez de interromper a narrativa, o relacionamento surgiu como consequência dos acontecimentos anteriores, reforçando a sensação de continuidade entre os diferentes estilos.
Por fim, o último trecho retomou o clima sombrio, agora em um contexto de terror.
O reaparecimento das caixas, a presença de uma terceira chave e a figura misteriosa surgindo na escuridão encerraram a história de forma inquietante, sem romper a lógica construída desde o primeiro parágrafo.
Embora cada parte apresente características típicas de um gênero específico, o ChatGPT conseguiu preservar a coerência da narrativa.
Os personagens permaneceram os mesmos, os acontecimentos seguiram uma sequência lógica e as mudanças de estilo ocorreram sem causar a impressão de que eram histórias independentes.
Veredito: ✅ Passou no teste.
O ChatGPT respeitou todos os estilos solicitados, manteve os cinco parágrafos e conseguiu construir uma narrativa coesa, demonstrando boa capacidade de controlar diferentes gêneros literários dentro de uma única história.
ChatGPT x Copilot? Veja diferenças, semelhanças e qual é o melhor
Teste 9 – Compare duas tecnologias e apresente prós e contras em tabela
Prompt utilizado
Compare React e Vue em uma tabela considerando curva de aprendizado, desempenho, ecossistema, documentação, facilidade de manutenção, comunidade, oportunidades no mercado e casos de uso.
Ao final, indique em quais cenários cada tecnologia é mais recomendada.
Comparar tecnologias é uma tarefa frequente para assistentes de inteligência artificial.
Diferentemente de perguntas objetivas, esse tipo de solicitação exige organizar informações, evitar vieses e apresentar uma análise equilibrada, permitindo que o usuário compreenda as vantagens e limitações de cada alternativa.
Neste teste, o ChatGPT precisava comparar dois dos principais frameworks para desenvolvimento de interfaces web.
Além de abordar oito critérios específicos, a resposta deveria ser apresentada em formato de tabela e terminar com recomendações de uso para cada tecnologia.
Comparação de tecnologias feita pelo ChatGPT
Captura de tela / Eduarda Melo
O modelo atendeu integralmente ao formato solicitado.
A comparação foi organizada em uma tabela clara, analisando React e Vue em critérios como curva de aprendizado, desempenho, ecossistema, documentação, manutenção, comunidade, mercado de trabalho e principais casos de uso.
Em vez de apontar um "vencedor", a IA destacou os pontos fortes de cada ferramenta conforme o contexto.
Outro aspecto positivo foi o equilíbrio da análise.
O ChatGPT reconheceu que o React possui um ecossistema mais amplo e maior presença no mercado, especialmente em grandes empresas e projetos corporativos.
Ao mesmo tempo, destacou que o Vue costuma oferecer uma curva de aprendizado mais suave, documentação bastante elogiada e uma estrutura mais padronizada, características valorizadas por equipes menores e projetos que priorizam rapidez no desenvolvimento.
Após a tabela, a resposta apresentou recomendações práticas para cada cenário.
O React foi indicado para aplicações de grande porte, projetos com potencial de crescimento e equipes que desejam aproveitar um ecossistema amplo ou utilizar React Native no desenvolvimento móvel.
Já o Vue foi recomendado para projetos pequenos e médios, equipes que buscam maior produtividade inicial e desenvolvedores iniciantes.
Embora alguns aspectos, como desempenho ou facilidade de manutenção, possam variar conforme a arquitetura adotada e a experiência da equipe, o ChatGPT evitou afirmações absolutas e tratou essas diferenças de forma contextualizada.
Essa abordagem torna a comparação mais útil para quem busca apoio na tomada de decisão.
Veredito: ✅ Passou no teste.
O ChatGPT organizou as informações em uma tabela completa, apresentou uma comparação equilibrada entre React e Vue e concluiu com recomendações coerentes para diferentes cenários de desenvolvimento, atendendo integralmente ao que foi solicitado.
ChatGPT simula como você vai envelhecer; confira prompt para entrar na trend
Teste 10 – Resolva um problema matemático explicando cada etapa
Prompt utilizado:
Um reservatório contém 2.400 litros de água.
A cada hora entram 180 litros e saem 120 litros.
Em quanto tempo ele atingirá 3.600 litros? Resolva o problema mostrando todos os cálculos e explicando cada etapa do raciocínio.
Problemas matemáticos nem sempre avaliam apenas a capacidade de realizar cálculos.
Em muitos casos, o principal desafio é organizar o raciocínio de forma lógica, identificar os dados relevantes e explicar cada etapa da resolução de maneira compreensível.
Por isso, esse tipo de exercício é bastante utilizado para testar a consistência do raciocínio de modelos de inteligência artificial.
Neste teste, o ChatGPT não deveria apenas informar o resultado final.
O prompt exigia que a IA apresentasse todos os cálculos, justificasse cada operação realizada e demonstrasse que a resposta obtida era realmente compatível com os dados do problema.
Resolução de problema matemático feita pelo ChatGPT
Captura de tela / Eduarda Melo
A resposta foi estruturada de forma organizada, começando pela identificação das informações fornecidas no enunciado: volume inicial do reservatório, quantidade de água que entra por hora, volume que sai no mesmo período e o objetivo final de 3.600 litros.
Essa organização facilita a compreensão do problema antes mesmo do início dos cálculos.
Na sequência, o modelo calculou corretamente o ganho líquido de água por hora, subtraindo a vazão de saída da vazão de entrada e concluindo que o reservatório aumenta seu volume em 60 litros por hora.
Em seguida, determinou que seriam necessários mais 1.200 litros para atingir o volume desejado e dividiu esse valor pelo ganho líquido, chegando ao resultado de 20 horas.
Outro ponto positivo foi a etapa de verificação.
Em vez de encerrar a resposta após encontrar o tempo necessário, o ChatGPT refez os cálculos considerando o período de 20 horas, demonstrando quanto de água entrou, quanto saiu e confirmando que o volume final realmente seria de 3.600 litros.
Essa conferência reduz a possibilidade de erros e reforça a confiabilidade da solução apresentada.
Do ponto de vista matemático, não foram identificadas falhas de cálculo nem problemas na sequência lógica do raciocínio.
A resposta também respeitou integralmente o que havia sido solicitado no prompt, explicando cada etapa sem omitir operações intermediárias.
Veredito: ✅ Passou no teste.
O ChatGPT resolveu corretamente o problema, apresentou todos os cálculos de forma organizada, explicou cada etapa do raciocínio e ainda verificou o resultado final, demonstrando consistência matemática e clareza na exposição da solução.
Com informações de ChatGPT.
Mais do TechTudo
Limites do ChatGPT: testamos 10 prompts para bugar a IA; resultado impressiona
Fonte:
