Reparo de codificação

Corrigir Mojibake Online

Recupere textos corrompidos por erro de codificação, como "João", "Informação", "Não" ou aspas quebradas como "“textoâ€". Cole o trecho, repare os caracteres e copie o resultado em segundos.

Grátis Sem login Privado No navegador

Antes e depois

Exemplos comuns de mojibake em português

Acentos e aspas recuperados

Antes

João
Informação
Não
Ação
Você
Olá
Ele disse: “está prontoâ€
Cliente’s arquivo

Depois

João
Informação
Não
Ação
Você
Olá
Ele disse: "está pronto"
Cliente's arquivo

Ferramenta

Cole o texto corrompido e recupere os caracteres legíveis

0 caracteres · 0 palavras · 0 linhas
0 caracteres · 0 palavras · 0 linhas

Conceito

O que é Mojibake

Mojibake é o nome dado ao texto que ficou ilegível por causa de uma incompatibilidade de codificação. O conteúdo original pode estar certo, mas os bytes foram interpretados com a tabela errada. Por isso uma palavra simples como João aparece como João, Informação vira Informação e aspas tipográficas podem surgir como “, ’ ou â€.

Isso é diferente de caracteres Unicode estranhos. Um espaço invisível, um hífen opcional ou um símbolo copiado de outro sistema pode ser um caractere real dentro do texto. Mojibake, por outro lado, costuma ser o rastro de uma conversão errada. Quando o padrão é reconhecível, a ferramenta tenta voltar ao caractere que deveria estar ali.

Origem do erro

Como o problema acontece

O caso mais comum acontece quando um texto salvo em UTF-8 é aberto como ISO-8859-1 ou Windows-1252. Esses padrões não leem os mesmos bytes da mesma forma. O resultado parece uma troca aleatória de letras, mas segue padrões conhecidos: acentos em português viram sequências com Ã, aspas e travessões vindos do Windows viram sequências com â, e marcadores especiais podem aparecer como blocos estranhos no meio da frase.

A falha costuma entrar em processos de importação e exportação: CSV aberto no Excel com encoding errado, sistemas legados que gravavam Latin-1, bancos de dados antigos migrados sem conversão, e-mails antigos, integrações internas e cópias de PDFs. Em muitos casos, o texto passa por mais de uma etapa antes de chegar até você, o que torna o erro mais difícil de perceber na origem.

Codificação

UTF-8 × ISO-8859-1 × Windows-1252

UTF-8

É o padrão moderno da web e suporta português, símbolos e muitos idiomas no mesmo arquivo. Quando lido do jeito certo, mantém acentos e pontuação sem ruído.

ISO-8859-1

Também chamado de Latin-1, foi muito usado em sistemas antigos e cobre vários caracteres da Europa Ocidental. O problema aparece quando ele tenta ler bytes que eram UTF-8.

Windows-1252

É uma variação comum em documentos e e-mails antigos do Windows. Aspas curvas, apóstrofos e travessões costumam quebrar quando são convertidos de modo incorreto.

Pipeline

Como a ferramenta funciona

A ferramenta usa o mesmo pipeline da versão em inglês. Ela procura marcadores típicos de mojibake, aplica reparos conservadores para erros de UTF-8 interpretado como Latin-1 ou Windows-1252 e só altera sequências compatíveis com esse tipo de problema. O objetivo não é reescrever frases, traduzir, resumir ou corrigir gramática: é recuperar caracteres.

Tudo roda localmente no navegador. Você pode colar uma frase, uma coluna de planilha, um trecho de CSV, uma mensagem antiga ou texto extraído de PDF. Depois de corrigir o mojibake, vale continuar o fluxo no Normalizador para padronizar espaços, no Remover Caracteres Unicode para remover marcas invisíveis ou no Corrigir Formatação quando o problema veio de copiar e colar.

Casos comuns

Onde mojibake costuma aparecer

CSV e planilhas Corrija colunas abertas com codificação errada.
Bancos de dados antigos Repare texto exportado depois de migrações legadas.
E-mails antigos Recupere acentos e aspas de mensagens arquivadas.
PDFs e OCR Limpe trechos copiados ou extraídos antes da revisão.
Sistemas legados Conserte relatórios vindos de aplicações antigas.
Integrações Padronize conteúdo que passou por APIs e exports.

Limites

Quando ela não consegue recuperar o texto

Nem todo texto estranho é mojibake reversível. Se o caractere original foi apagado, substituído manualmente, convertido mais de uma vez ou salvo como ponto de interrogação, talvez não exista informação suficiente para reconstruir o original. O mesmo vale para OCR que reconheceu uma letra errada: se um scanner leu rn como m, isso é erro de reconhecimento, não de codificação.

Para PDFs escaneados, use Limpar Texto OCR depois de extrair o texto. Para linhas quebradas de PDF selecionável, use Remover Quebras de PDF. Para texto com símbolos invisíveis, mas sem sequências como é, use Remover Caracteres Unicode.

Prevenção

Boas práticas para evitar mojibake

Use UTF-8 por padrão

Configure exports, bancos, páginas HTML e integrações para salvar e ler texto em UTF-8.

Declare o encoding

Em CSV, HTML, e-mails e APIs, deixe explícito o charset usado para evitar que outro sistema adivinhe errado.

Teste antes de migrar

Ao mover dados de sistemas legados, valide nomes, cidades, acentos e aspas em uma amostra real.

Próxima etapa

Normalize o texto recuperado antes de publicar.

Depois de corrigir o mojibake, revise o trecho, remova espaços ou marcas invisíveis e confira o tamanho final antes de colar em CMS, planilha, sistema interno ou documento.

Fluxo de correção de texto

FAQ

Dúvidas sobre corrigir mojibake

O que significa mojibake?

É texto embaralhado por incompatibilidade de codificação, como UTF-8 lido como ISO-8859-1 ou Windows-1252.

Por que aparece "é"?

Porque a letra acentuada foi lida com a tabela errada. Em muitos casos, "é" pode ser recuperado como "é".

Isso recupera textos do Word?

Sim, quando o texto copiado do Word sofreu erro de encoding. Para listas, estilos e espaços, use Corrigir Formatação.

Funciona com PDFs?

Sim, com texto já copiado ou extraído do PDF. A ferramenta não abre o arquivo PDF diretamente.

Corrige arquivos CSV?

Sim. Cole as linhas ou colunas afetadas para reparar acentos e aspas corrompidos por encoding.

Corrige bancos de dados?

Corrige o texto exportado ou copiado. Ela não se conecta ao banco nem altera registros.

O texto sai do navegador?

Não. O processamento acontece localmente no navegador, sem envio do conteúdo para servidores.

A ferramenta é gratuita?

Sim. É gratuita, sem login e pronta para uso online.