Lugares Favoritos da Sua Cidade Favorita
Início
Adicionar às fontes preferidas no Google

Limpeza de texto de PDF

Corrija quebras de linha e espaços indesejados no texto copiado de um PDF.

Cole ou escreva texto copiado de um PDF.

Atualiza automaticamente. O original fica disponível.

Como funciona e limites de entrada

Cole texto simples para o limpar automaticamente. As opções atualizam o resultado; ao escrever, a atualização ocorre após uma breve pausa. O original fica disponível até o editar ou apagar.

Limite: 500.000 unidades de código UTF-16, não caracteres visíveis. Textos maiores permanecem no editor, mas não podem ser processados.

O texto é processado localmente no navegador. Esta ferramenta não guarda nem envia rascunhos. Os serviços partilhados do site podem fazer pedidos de rede.

Opções de limpeza

A reparação de quebras usa heurísticas. Linhas vazias e listas, código, tabelas e links isolados reconhecidos são protegidos. Em caso de dúvida, use apenas espaços.

O modo automático omite o espaço apenas entre caracteres Han adjacentes; nos outros casos insere um espaço. Não identifica o idioma.

Cole texto para começar. A limpeza é automática.

Como limpar texto copiado de PDF

  1. Cole o texto original para iniciar a limpeza automática. Escolha reparar parágrafos ou apenas espaços e ative alterações opcionais só quando necessário.
  2. Reveja os excertos atualizados e decida se cada hífen duvidoso deve ser removido, mantido na junção ou deixado intacto. Cada decisão atualiza o resultado automaticamente.
  3. Copie o resultado quando o processamento terminar. Alterar o texto ou as opções atualiza o resultado e repõe as decisões sobre hífens; ao escrever, aguarda-se uma breve pausa. Apagar elimina ambos os textos e restaura as opções iniciais.

O que esta ferramenta altera

Ao copiar de um PDF, cada linha visual pode tornar-se uma linha de texto. Esta ferramenta une linhas elegíveis, mas uma quebra não revela a intenção do autor. Preserva parágrafos vazios, listas reconhecidas, código delimitado ou indentado, linhas tabulares e URLs, emails e caminhos isolados. A pontuação de fim de frase também impede a junção. Títulos, poesia e citações não são reconhecidos perfeitamente: reveja ou use apenas espaços.

Um hífen no fim da linha pode dividir uma palavra ou fazer parte de uma palavra composta. Cada ocorrência tem a sua decisão e fica intacta por predefinição. O resultado parte sempre do original atual, sem acumular alterações ao repor escolhas. Limpar novamente um resultado já limpo pode revelar novas junções; a repetição não garante o mesmo resultado.

O modo automático só omite espaços entre caracteres Han adjacentes. Não identifica idiomas nem deduz todas as separações em japonês, coreano, tailandês ou khmer. As opções limitam-se a U+00AD, ff/fi/fl/ffi/ffl, U+00A0/U+202F e espaços ASCII repetidos. Estruturas protegidas ficam intactas. Tabulações, espaços finais de quebra, acentos combinantes, emoji, controlos de escrita e outros caracteres Unicode são preservados.

Exemplos: antes → depois

A wrapped ␊ sentence. → A wrapped sentence. (␊ indica uma quebra de linha, sem os espaços de apresentação à volta.)

inter-␊national → intacto por predefinição; remover o hífen produz international e mantê-lo produz inter-national. state-␊of-the-art → state-of-the-art ao manter o hífen.

中文␊文本 → 中文文本 no modo automático. file → file apenas com expansão de ligaduras. First paragraph.␊␊Second paragraph. mantém ambas as quebras.

Processamento local e limites

O texto é processado no navegador; esta ferramenta não envia nem guarda rascunhos. A análise e a publicidade partilhadas do site podem fazer pedidos de rede. Editores e excertos usam os atributos de ocultação do site. O limite de 500.000 unidades UTF-16 não conta caracteres visíveis: um emoji pode ocupar várias unidades. O texto acima do limite é preservado sem cortes.

Perguntas frequentes

Não. Cole apenas texto simples. PDFs digitalizados precisam primeiro de OCR noutra ferramenta. Não é possível reconstruir colunas, tabelas ou a ordem de leitura perdida. Números de página, cabeçalhos repetidos e citações não são removidos.

Um hífen de palavra composta pode ser idêntico a uma divisão tipográfica. Na dúvida, mantenha o limite original e reveja cada ocorrência.

Leia as linhas unidas no contexto. As ferramentas relacionadas abaixo ajudam a contar caracteres, medir o tamanho codificado do texto ou calcular segmentos de SMS.

Contador de caracteres e segmentos SMS

Veja a codificação da mensagem, os limites dos segmentos e o possível custo. O texto fica no seu navegador.

Abrir ferramentaContador de caracteres e segmentos SMS

Contador de caracteres para redes sociais

Confira os limites de cada plataforma e divida publicações sem perder texto.

Abrir ferramentaContador de caracteres para redes sociais

Contador de caracteres

Conte caracteres, palavras, frases e parágrafos. Consulte a densidade de palavras, o tempo de leitura e o tamanho UTF-8 no navegador.

Abrir ferramentaContador de caracteres

Calculadora de tamanho de texto

Compare codificações e tamanhos de dados de texto no navegador.

Abrir ferramentaCalculadora de tamanho de texto