- Texto de IA costuma ter estrutura uniforme demais: parágrafos do mesmo tamanho, frases de complexidade parecida e transições formulaicas.
- Em português, muletas como "é importante ressaltar", "em suma" e "vale destacar" aparecem com frequência muito acima do normal.
- Detectores como GPTZero e Copyleaks anunciam precisão de 99%, mas testes independentes encontram números bem menores em cenários reais.
- Texto "humanizado" (reescrito ou passado por ferramentas de parafraseamento) derruba a taxa de acerto dos detectores para perto de 50%.
- Falso positivo existe e prejudica gente de verdade — nunca acuse alguém com base em um único resultado de detector.
Leia o texto inteiro antes de rodar qualquer ferramenta
Parece burocracia, mas é o passo que mais gente pula. Detectores analisam padrões estatísticos; você analisa sentido. Um texto de IA pode estar gramaticalmente perfeito e, ainda assim, não dizer nada — exemplos genéricos, zero casos concretos, nenhuma opinião. Se depois de três parágrafos você não consegue apontar uma informação que só aquele autor saberia, acenda o alerta.
Procure os sinais de estrutura
Texto de IA tende a ser simétrico demais: parágrafos com quase o mesmo número de linhas, frases de complexidade parecida, introdução que anuncia exatamente o que vem e conclusão que resume tudo de novo. Escrita humana é mais bagunçada — tem frase curta, tem período longo, tem parágrafo de uma linha só porque o autor quis dar ênfase.
Cace as muletas de linguagem
Em português, os modelos adoram certas expressões: "é importante ressaltar que", "cabe destacar", "em suma", "nesse sentido", "no cenário atual". Uma ou duas podem aparecer em qualquer texto. Cinco delas em duas páginas é padrão de máquina. O contrário também vale: IA quase nunca escreve "pra", "tá", "né" nem usa expressão regional brasileira de forma natural.
Rode o texto em dois detectores diferentes, não em um
GPTZero e Copyleaks são os mais citados em comparativos. O ponto é usar os dois e comparar: se ambos apontarem alta probabilidade de IA, a suspeita ganha força; se divergirem, o resultado não serve para nada além de curiosidade. Detectores trabalham com probabilidade, e textos curtos (menos de 300 palavras) confundem qualquer um deles.
Verifique fatos e referências citadas
Aqui os modelos ainda escorregam: inventam estatísticas, citam livros que não existem e atribuem frases a quem nunca as disse. Pegue duas ou três afirmações verificáveis do texto e pesquise. Referência fantasma é um dos indícios mais fortes de geração automática — mais confiável que qualquer porcentagem de detector. Se quiser entender por que isso acontece, vale ler sobre alucinação em IA.
Se for decisão séria, converse antes de acusar
Professor avaliando trabalho, editor avaliando freela, RH avaliando redação de candidato: em todos esses casos, o detector é indício, não veredito. Pessoas que escrevem de forma muito padronizada — e estudantes que aprenderam português como segunda língua — são vítimas frequentes de falso positivo. Uma conversa de cinco minutos pedindo para a pessoa explicar o próprio texto resolve mais que qualquer ferramenta.
O que os detectores de IA realmente conseguem fazer
Detectores de texto de IA analisam duas coisas, basicamente: a previsibilidade das palavras (perplexidade) e a variação entre frases (burstiness). Texto de máquina tende a escolher sempre a palavra mais provável e a manter ritmo constante. Texto humano oscila.
No papel, os números impressionam. O GPTZero divulga precisão de 99% em seus benchmarks, e o Copyleaks anuncia taxa de falso positivo de apenas 0,2%. Só que testes independentes contam outra história: um comparativo publicado em 2026 mediu 81% de acerto do GPTZero em texto de IA puro — e apenas 54% quando o texto passou por "humanização". O Copyleaks, no mesmo teste, ficou em 76% e 49%, respectivamente.
Ou seja: contra texto de IA cru, colado direto do ChatGPT, os detectores funcionam razoavelmente bem. Contra texto editado, reescrito ou parafraseado, viram cara ou coroa.
Comparativo rápido: os detectores mais usados
A tabela abaixo resume o que os comparativos independentes de 2026 apontam sobre as ferramentas mais populares. Os números variam entre testes — trate como ordem de grandeza, não como precisão de laboratório.
| Ferramenta | Ponto forte | Ponto fraco | Custo |
|---|---|---|---|
| GPTZero | Boa taxa de acerto em texto de IA puro (~81% em teste independente) | Falso positivo em torno de 7%; cai muito com texto humanizado | Gratuito com limite; planos pagos |
| Copyleaks | Menor taxa de falso positivo entre os testados | Acerto menor em texto de IA puro (~76%) | Pago, com teste grátis |
| Turnitin | Integrado ao fluxo acadêmico de universidades | Fechado para uso individual; sem transparência nos critérios | Licença institucional |
| Leitura crítica humana | Pega o que detector não pega: falta de substância e referência inventada | Exige tempo e repertório do avaliador | Grátis |
Por que o falso positivo é o problema mais grave
Quando um detector marca texto humano como IA, alguém real paga a conta: aluno reprovado, freelancer que perde o cliente, candidato eliminado. E os testes mostram que isso não é raro — taxas de falso positivo entre 6% e 8% apareceram em comparativos recentes, o que significa quase 1 texto humano em cada 12 sendo acusado injustamente.
Há um viés cruel nisso: quem escreve de forma correta, organizada e sem gírias — exatamente o que a escola ensina — produz texto estatisticamente parecido com o de uma máquina. Escritores não nativos sofrem ainda mais, porque tendem a usar estruturas mais previsíveis.
Por isso a regra prática é simples: detector serve para levantar suspeita, nunca para fechar caso. Quem entende como um modelo de linguagem gera texto — sempre apostando na palavra mais provável — entende também por que essa fronteira nunca será limpa.
O jogo de gato e rato não vai acabar
Cada geração de modelo escreve de forma mais natural, e cada onda de "humanizadores" aprende a driblar os detectores da vez. Os próprios comparativos de 2026 já tratam a detecção de texto humanizado como o calcanhar de aquiles da categoria inteira.
Na prática, a habilidade que valoriza é outra: avaliar substância. Um texto com dado verificável, exemplo específico e ponto de vista próprio tem valor, tenha sido escrito com ou sem ajuda de IA. Um texto vazio é vazio de qualquer jeito — e nenhum detector precisa te dizer isso.
Perguntas frequentes
Existe algum detector de IA 100% confiável?
O ChatGPT consegue dizer se um texto foi escrito por IA?
Professor pode reprovar aluno com base em detector de IA?
Texto de IA editado por humano ainda é detectável?
- Forbes Brasil — Como identificar se um texto foi escrito por inteligência artificial
- Canaltech — 7 dicas para descobrir se um texto foi escrito por IA
- Exame — Como saber se um texto foi feito por inteligência artificial?
- Detector de IA — Os melhores detectores de IA em 2026: comparativa com dados reais
- Aithor — GPTZero review 2026: teste de precisão em detecção de IA
Leia também
Alucinação em IA
O que é alucinação em inteligência artificial, por que acontece com ChatGPT e outros modelos, e como evitar nas suas consultas. Explicação simples com exemplos.
Ler →
LLM (Modelo de Linguagem de Grande Escala)
O que é LLM, como funciona e exemplos práticos. Explicação de modelos de linguagem de grande escala em linguagem acessível, sem termos técnicos desnecessários.
Ler →
Como criar prompts melhores para IA: 7 técnicas que funcionam
7 técnicas práticas de prompt engineering para tirar respostas muito melhores do ChatGPT, Claude e outras IAs. Com exemplos prontos em português.
Ler →
Como usar IA para professores: guia prático passo a passo
Guia passo a passo para professores aprenderem a usar IA no planejamento de aulas, criação de materiais e feedback a alunos. Ferramentas gratuitas e aplicações reais.
Ler →