# ChatGPT corrige redação do ENEM? O que esperar e como usar

O ChatGPT consegue apontar erros de norma padrão, verificar a estrutura dos parágrafos e conferir os elementos da proposta de intervenção. A nota que ele atribui, porém, é pouco confiável: estudos de 2026 mostram que modelos de linguagem dão notas mais altas que corretores humanos justamente a textos curtos e subdesenvolvidos.

*Publicado em 18 de agosto de 2026 · atualizado em 18 de agosto de 2026 · Agora Passei (https://agorapassei.app/blog/chatgpt-corrige-redacao-do-enem)*

## Em resumo

- Estudo de março de 2026 documentou que LLMs pontuam textos curtos acima do que humanos pontuariam.
- Estudo do PROPOR 2026 com redações do ENEM mediu concordância de até 0,73 em argumentação e 0,60 em estilo.
- Uma síntese de 65 estudos encontrou concordância entre 0,30 e 0,80 — faixa larga demais para confiar num número isolado.
- Chatbot genérico tende a elogiar: sem instrução explícita, ele responde ao que você pediu, não ao critério da banca.
- A correção oficial do ENEM continua humana, com dois avaliadores independentes.

> **Declaração de interesse** — O Agora Passei é um corretor de redação com IA, então temos interesse comercial neste assunto. É justamente por isso que este texto é específico sobre o que a tecnologia faz mal — inclusive no nosso caso.

## O que acontece quando você cola a redação no ChatGPT

Duas coisas, e é importante separá-las. A primeira é um **comentário qualitativo** — normalmente correto, às vezes muito útil: apontamentos de gramática, observações sobre estrutura, sugestões de conectivo. A segunda é uma **nota** — e é ela que merece desconfiança.

O motivo não é misterioso. Um chatbot genérico é otimizado para ser útil e agradável na conversa, não para reproduzir o julgamento de uma banca. Sem instrução firme, ele tende a começar pelo elogio, encontrar pontos positivos e arredondar a nota para cima.

## O viés documentado: nota alta para texto curto

Não é impressão. Um estudo publicado em março de 2026, com o título direto de *LLMs Do Not Grade Essays Like Humans*, encontrou concordância relativamente fraca entre modelos de linguagem e avaliadores humanos, com um padrão claro na direção do erro:

- **Redações curtas e subdesenvolvidas** recebem dos modelos notas **mais altas** do que receberiam de humanos.
- **Textos longos com erros gramaticais menores** recebem notas **mais baixas** do que humanos dariam.
- Ou seja: os modelos usam sinais diferentes dos que corretores humanos usam para decidir.

> **Por que isso é perigoso para quem estuda** — O aluno que escreve 18 linhas rasas e recebe “850” do chatbot conclui que está pronto. É exatamente o perfil que a banca penaliza nas Competências 3 e 5 — desenvolvimento insuficiente e proposta pouco detalhada.

## Quanto os modelos concordam com humanos, em número

| Evidência | Resultado |
| --- | --- |
| Estudo do PROPOR 2026, com 385 redações do ENEM em 38 propostas | Concordância (QWK) de até **0,73 em argumentação** e **0,60 em estilo**, ainda distante do patamar considerado ideal. Nenhuma abordagem cobriu bem todos os critérios |
| Síntese de 65 estudos sobre concordância entre LLMs e avaliadores humanos | Índices majoritariamente entre **0,30 e 0,80**, com alta variabilidade entre estudos |

Traduzindo: em argumentação, os modelos chegam perto de um corretor razoável. Em estilo, ficam bem atrás. E a variação entre estudos é grande o bastante para que **nenhum número isolado de nota deva ser tratado como verdade**.

## O que o ChatGPT faz bem na sua redação

| Tarefa | Confiabilidade | Observação |
| --- | --- | --- |
| Encontrar desvio de crase, concordância e pontuação | **Alta** | É padrão verificável no próprio texto |
| Dizer se há quatro parágrafos com funções distintas | **Alta** | Estrutura é identificável por forma |
| Conferir os cinco elementos da proposta de intervenção | **Alta** | É checklist explícito |
| Apontar repetição de conectivo | **Alta** | Contagem, não julgamento |
| Sugerir reescrita de um trecho | **Boa** | Útil como alternativa, não como gabarito |
| Dizer se o repertório está conectado ao argumento | **Média** | Exige julgar sustentação, não presença |
| Detectar tangenciamento fino do recorte | **Baixa** | Precisa comparar o texto com cada camada do enunciado |
| Atribuir a nota que a banca daria | **Baixa** | É o achado central dos estudos |

## Como pedir uma correção mais dura

Se você vai usar um chatbot genérico, a instrução muda bastante o resultado. Peça o critério, não a opinião — e force a resposta a se ancorar no texto.

1. **Dê o critério oficial, não só a redação** — Cole o tema **completo**, com o recorte, e diga que a avaliação deve seguir as cinco competências do ENEM, com níveis de 0 a 200 em cada uma.
2. **Peça citação do trecho para cada apontamento** — “Para cada problema, cite o trecho exato do meu texto.” Isso reduz muito comentário genérico e obriga o modelo a olhar o que está escrito.
3. **Peça o argumento contra antes da nota** — “Antes de dar a nota, escreva o caso mais duro contra este texto: o que um corretor rigoroso apontaria?” Inverter a ordem reduz o viés de elogio.
4. **Pergunte especificamente sobre o recorte** — “Meu texto trata de todas as camadas do enunciado ou apenas do assunto amplo?” É a pergunta que o modelo não faz sozinho — e é o erro mais caro da prova.
5. **Ignore o número e leia os apontamentos** — A lista de problemas é o produto. A nota é ruído com margem grande.

> **Um teste que vale fazer** — Peça a correção da mesma redação três vezes, em conversas separadas. Se a nota variar 100 pontos entre elas — e costuma variar —, você acabou de medir a confiabilidade daquele número na prática.

## O que muda numa ferramenta feita só para isso

Os cinco truques de prompt acima existem porque um chatbot genérico não foi construído para a matriz do ENEM — você precisa recriar, na mão, o que uma ferramenta dedicada já faz por padrão. No Agora Passei, três coisas resolvem justamente os pontos fracos documentados nesta página:

- **Segundo parecer automático**, sem você precisar pedir — no Premium e em competições, dois avaliadores de IA independentes corrigem cada redação; nos planos comuns, um segundo parecer entra sozinho quando o primeiro está incerto ou aponta algo sensível.
- **Desempate pelo critério oficial**: quando os dois pareceres divergem mais de 100 pontos no total ou 80 pontos numa competência — o mesmo limiar do Inep — um terceiro parecer decide, em vez de uma média cega.
- **Evidência obrigatória**: o modelo só atribui nível a uma competência citando o trecho do seu próprio texto que sustenta aquele nível.

_Isso é o que o pedido de prompt tenta simular na mão. Aqui já vem pronto — com dupla correção, desempate e evidência por competência._

## O ENEM vai corrigir com IA?

Hoje, não. A correção oficial segue humana, com no mínimo dois avaliadores independentes graduados em Letras ou Linguística. Em junho de 2026, o Inep anunciou uma **prova de conceito** com empresas de tecnologia para avaliar o uso de IA — com objetivo declarado de acelerar a divulgação da folha espelho e da avaliação pedagógica, não de substituir a nota humana.

Redes estaduais já usam correção automática há mais tempo, mas com um desenho revelador: em São Paulo, a correção da IA na plataforma Redação Paulista **passa pelo professor**, que valida ou altera a nota sugerida. IA propõe, humano decide — é o arranjo que a prática e a regulação em discussão vêm convergindo a adotar.

Comparativo completo em [correção humana vs IA](/blog/correcao-humana-vs-ia), e a evidência técnica reunida em [corretor de redação com IA funciona?](/blog/corretor-de-redacao-com-ia-funciona).

## Perguntas frequentes

### O ChatGPT sabe corrigir redação do ENEM?

Sabe apontar erros de norma, verificar estrutura e conferir os elementos da proposta de intervenção. A nota que ele atribui é pouco confiável: estudos de 2026 mostram concordância moderada com humanos e viés a favor de textos curtos.

### A nota que o ChatGPT dá é parecida com a do ENEM?

Não necessariamente. A pesquisa mais recente indica que modelos de linguagem tendem a dar notas mais altas que humanos a redações curtas e subdesenvolvidas, e mais baixas a textos longos com erros gramaticais pequenos.

### Como pedir para a IA corrigir minha redação direito?

Cole o tema completo com o recorte, peça avaliação pelas cinco competências, exija que cada apontamento cite o trecho exato do seu texto e peça o argumento contrário antes da nota. Depois, leia os apontamentos e ignore o número.

### Usar IA para corrigir redação é trapaça?

Não. Usar como diagnóstico do próprio texto é estudo. O problema seria entregar como sua uma redação escrita pela IA — aí não há treino nenhum, e a habilidade que a prova mede continua exatamente onde estava.

## Fontes

- [LLMs Do Not Grade Essays Like Humans (2026)](https://arxiv.org/html/2603.23714v1) — arXiv
- [Automated Essay Scoring for Brazilian Portuguese: Evidence from Cross-Prompt Evaluation of ENEM Essays (PROPOR 2026)](https://aclanthology.org/2026.propor-2.11/) — ACL Anthology
- [Inep nega mudança nos critérios da redação do Enem e estuda uso de IA para agilizar divulgação de notas](https://www.camara.leg.br/noticias/1281239-inep-nega-mudanca-nos-criterios-da-redacao-do-enem-e-estuda-uso-de-ia-para-agilizar-divulgacao-de-notas) — Câmara dos Deputados
