
O que acontece quando você cola a redação no ChatGPT
Duas coisas, e é importante separá-las. A primeira é um comentário qualitativo — normalmente correto, às vezes muito útil: apontamentos de gramática, observações sobre estrutura, sugestões de conectivo. A segunda é uma nota — e é ela que merece desconfiança.
O motivo não é misterioso. Um chatbot genérico é otimizado para ser útil e agradável na conversa, não para reproduzir o julgamento de uma banca. Sem instrução firme, ele tende a começar pelo elogio, encontrar pontos positivos e arredondar a nota para cima.
O viés documentado: nota alta para texto curto
Não é impressão. Um estudo publicado em março de 2026, com o título direto de *LLMs Do Not Grade Essays Like Humans*, encontrou concordância relativamente fraca entre modelos de linguagem e avaliadores humanos, com um padrão claro na direção do erro:
- Redações curtas e subdesenvolvidas recebem dos modelos notas mais altas do que receberiam de humanos.
- Textos longos com erros gramaticais menores recebem notas mais baixas do que humanos dariam.
- Ou seja: os modelos usam sinais diferentes dos que corretores humanos usam para decidir.
Quanto os modelos concordam com humanos, em número
| Evidência | Resultado |
|---|---|
| Estudo do PROPOR 2026, com 385 redações do ENEM em 38 propostas | Concordância (QWK) de até 0,73 em argumentação e 0,60 em estilo, ainda distante do patamar considerado ideal. Nenhuma abordagem cobriu bem todos os critérios |
| Síntese de 65 estudos sobre concordância entre LLMs e avaliadores humanos | Índices majoritariamente entre 0,30 e 0,80, com alta variabilidade entre estudos |
Traduzindo: em argumentação, os modelos chegam perto de um corretor razoável. Em estilo, ficam bem atrás. E a variação entre estudos é grande o bastante para que nenhum número isolado de nota deva ser tratado como verdade.
O que o ChatGPT faz bem na sua redação
| Tarefa | Confiabilidade | Observação |
|---|---|---|
| Encontrar desvio de crase, concordância e pontuação | Alta | É padrão verificável no próprio texto |
| Dizer se há quatro parágrafos com funções distintas | Alta | Estrutura é identificável por forma |
| Conferir os cinco elementos da proposta de intervenção | Alta | É checklist explícito |
| Apontar repetição de conectivo | Alta | Contagem, não julgamento |
| Sugerir reescrita de um trecho | Boa | Útil como alternativa, não como gabarito |
| Dizer se o repertório está conectado ao argumento | Média | Exige julgar sustentação, não presença |
| Detectar tangenciamento fino do recorte | Baixa | Precisa comparar o texto com cada camada do enunciado |
| Atribuir a nota que a banca daria | Baixa | É o achado central dos estudos |
Como pedir uma correção mais dura
Se você vai usar um chatbot genérico, a instrução muda bastante o resultado. Peça o critério, não a opinião — e force a resposta a se ancorar no texto.
Dê o critério oficial, não só a redação
Cole o tema completo, com o recorte, e diga que a avaliação deve seguir as cinco competências do ENEM, com níveis de 0 a 200 em cada uma.
Peça citação do trecho para cada apontamento
“Para cada problema, cite o trecho exato do meu texto.” Isso reduz muito comentário genérico e obriga o modelo a olhar o que está escrito.
Peça o argumento contra antes da nota
“Antes de dar a nota, escreva o caso mais duro contra este texto: o que um corretor rigoroso apontaria?” Inverter a ordem reduz o viés de elogio.
Pergunte especificamente sobre o recorte
“Meu texto trata de todas as camadas do enunciado ou apenas do assunto amplo?” É a pergunta que o modelo não faz sozinho — e é o erro mais caro da prova.
Ignore o número e leia os apontamentos
A lista de problemas é o produto. A nota é ruído com margem grande.
O que muda numa ferramenta feita só para isso
Os cinco truques de prompt acima existem porque um chatbot genérico não foi construído para a matriz do ENEM — você precisa recriar, na mão, o que uma ferramenta dedicada já faz por padrão. No Agora Passei, três coisas resolvem justamente os pontos fracos documentados nesta página:
- Segundo parecer automático, sem você precisar pedir — no Premium e em competições, dois avaliadores de IA independentes corrigem cada redação; nos planos comuns, um segundo parecer entra sozinho quando o primeiro está incerto ou aponta algo sensível.
- Desempate pelo critério oficial: quando os dois pareceres divergem mais de 100 pontos no total ou 80 pontos numa competência — o mesmo limiar do Inep — um terceiro parecer decide, em vez de uma média cega.
- Evidência obrigatória: o modelo só atribui nível a uma competência citando o trecho do seu próprio texto que sustenta aquele nível.
O ENEM vai corrigir com IA?
Hoje, não. A correção oficial segue humana, com no mínimo dois avaliadores independentes graduados em Letras ou Linguística. Em junho de 2026, o Inep anunciou uma prova de conceito com empresas de tecnologia para avaliar o uso de IA — com objetivo declarado de acelerar a divulgação da folha espelho e da avaliação pedagógica, não de substituir a nota humana.
Redes estaduais já usam correção automática há mais tempo, mas com um desenho revelador: em São Paulo, a correção da IA na plataforma Redação Paulista passa pelo professor, que valida ou altera a nota sugerida. IA propõe, humano decide — é o arranjo que a prática e a regulação em discussão vêm convergindo a adotar.
Comparativo completo em correção humana vs IA, e a evidência técnica reunida em corretor de redação com IA funciona?.
Perguntas frequentes
O ChatGPT sabe corrigir redação do ENEM?
Sabe apontar erros de norma, verificar estrutura e conferir os elementos da proposta de intervenção. A nota que ele atribui é pouco confiável: estudos de 2026 mostram concordância moderada com humanos e viés a favor de textos curtos.
A nota que o ChatGPT dá é parecida com a do ENEM?
Não necessariamente. A pesquisa mais recente indica que modelos de linguagem tendem a dar notas mais altas que humanos a redações curtas e subdesenvolvidas, e mais baixas a textos longos com erros gramaticais pequenos.
Como pedir para a IA corrigir minha redação direito?
Cole o tema completo com o recorte, peça avaliação pelas cinco competências, exija que cada apontamento cite o trecho exato do seu texto e peça o argumento contrário antes da nota. Depois, leia os apontamentos e ignore o número.
Usar IA para corrigir redação é trapaça?
Não. Usar como diagnóstico do próprio texto é estudo. O problema seria entregar como sua uma redação escrita pela IA — aí não há treino nenhum, e a habilidade que a prova mede continua exatamente onde estava.
Fontes
- LLMs Do Not Grade Essays Like Humans (2026) — arXiv
- Automated Essay Scoring for Brazilian Portuguese: Evidence from Cross-Prompt Evaluation of ENEM Essays (PROPOR 2026) — ACL Anthology
- Inep nega mudança nos critérios da redação do Enem e estuda uso de IA para agilizar divulgação de notas — Câmara dos Deputados
Versão em texto puro desta página, para leitura por ferramentas de IA: /blog/md/chatgpt-corrige-redacao-do-enem.md
