Limpeza de Unicode

Remover caracteres Unicode estranhos

Remova caracteres invisíveis, espaços zero-width, NBSP, soft hyphen, ligaduras e marcas Unicode estranhas de textos copiados.

Zero-width NBSP Soft hyphen Invisíveis

Ferramenta

Cole o texto com Unicode estranho, limpe e copie o resultado

0 caracteres · 0 palavras · 0 linhas
0 caracteres · 0 palavras · 0 linhas

Quando usar

Quando remover caracteres Unicode estranhos?

Use esta ferramenta quando um texto copiado de documentos, páginas web, e-mails, Word ou aplicativos chega com espaços invisíveis, zero-width, NBSP, soft hyphen, ligaduras ou marcas Unicode estranhas.

Os problemas mais comuns são zero width spaces, espaços invisíveis, hífen opcional, marcadores BOM, ligaduras e espaços não separáveis. A limpeza ajuda a preparar o conteúdo antes de revisar, publicar ou enviar para outra ferramenta.

Menos ruído visual

Remove sinais quebrados que aparecem depois da colagem.

Busca mais confiável

Elimina caracteres ocultos que impedem localizar palavras.

Importações estáveis

Prepara texto para planilhas, CMS, CRMs e automações.

Revisão mais rápida

Reduz correção manual de espaços e símbolos invisíveis.

Problemas comuns

Problemas comuns que esta ferramenta corrige

Espaços invisíveis Limpa zero width spaces, NBSP e marcadores ocultos.
Soft hyphen Remove hífens opcionais que quebram busca e colagem.
Ligaduras Normaliza sinais como fi e fl quando atrapalham revisão.
Espaços invisíveis Limpa zero width spaces, NBSP e marcadores ocultos.
Caracteres não imprimíveis Remove marcas que atrapalham formulários e editores.
Unicode misturado Padroniza texto vindo de várias fontes no mesmo bloco.
Texto quebrado ao colar Reduz símbolos que aparecem entre palavras e frases.
Problemas em planilhas Ajuda antes de importar, comparar ou deduplicar dados.

Modos rápidos

Escolha o tipo de Unicode que você vê

Onde é útil

Onde essa limpeza é útil

Revisão e publicação

Prepare artigos, descrições, legendas e documentos antes de colar no editor final.

Dados e automação

Reduza falhas de validação, comparação, busca e importação.

OCR e digitalização

Limpe ligaduras, espaços especiais e marcas geradas por OCR.

Tradução e localização

Corrija ruído antes de traduzir, revisar ou adaptar conteúdo.

Planilhas e importações

Evite células com caracteres ocultos que parecem iguais, mas não comparam corretamente.

Conteúdo para web

Prepare texto para CMS, campos de formulário, HTML e sistemas com limite de caracteres.

Fluxo recomendado

Do Unicode quebrado ao texto publicável

Comece por Limpar Texto OCR quando o texto saiu de um scanner ou PDF escaneado. Comece por Corrigir Formatação quando o texto acabou de ser colado de Word, Google Docs ou páginas web. Se o problema principal são espaços invisíveis, zero-width, NBSP ou soft hyphen, remova o Unicode estranho. Depois use a Limpeza de Texto de IA para resolver quebras, Markdown e formatação copiada. Em seguida, passe pelo Normalizador para padronizar espaços e pontuação, conte o resultado no Contador de Palavras e publique.

Método

Como corrigir Unicode sem destruir o texto

A melhor limpeza é conservadora: primeiro remova artefatos técnicos, depois ajuste formatação. Por isso esta ferramenta trata caracteres invisíveis, marcadores BOM, espaços especiais, aspas incomuns e ligaduras antes de qualquer etapa de normalização mais ampla. Assim, um texto copiado de PDF ou OCR perde o ruído que atrapalha a revisão, mas preserva palavras, parágrafos e sentido.

Se o conteúdo ainda tiver linhas cortadas, listas desalinhadas, Markdown ou excesso de espaços depois da limpeza Unicode, continue com as ferramentas do cluster de limpeza. Esse fluxo evita aplicar ajustes agressivos logo no início e facilita identificar qual problema veio do arquivo original, da extração, do editor ou da etapa de publicação.

Próxima etapa

Normalize o texto antes de publicar.

Após remover caracteres Unicode estranhos, normalize o texto, elimine problemas de formatação e confira o tamanho final do conteúdo antes de publicar.

Abrir Normalizador

FAQ

Dúvidas sobre remover caracteres Unicode estranhos

O que são caracteres Unicode estranhos?

São símbolos corrompidos, espaços especiais, marcas invisíveis, ligaduras e caracteres copiados incorretamente de documentos, páginas web ou aplicativos.

Remove espaços invisíveis?

Sim. Remove zero width spaces, NBSP, hífen opcional, BOM e outras marcas ocultas compatíveis.

A ferramenta remove caracteres invisíveis?

Sim. Ela remove zero width spaces, joiners, marcadores de direção, BOM, hífen opcional e espaços não separáveis.

Ela altera o conteúdo do texto?

Ela corrige ruído técnico, espaçamento e pontuação suspeita, mas não reescreve frases nem muda a intenção do texto.

Posso usar em texto gerado por IA?

Sim. Use em respostas do ChatGPT, Gemini e outras ferramentas quando aparecerem símbolos estranhos ou espaços ocultos.

Corrige mojibake?

Não é o foco. Mojibake, como João ou Français, é problema de encoding e precisa de uma ferramenta específica.