Lugares favoritos de tu ciudad favorita
Inicio
Añadir a fuentes preferidas en Google

Limpieza de texto de PDF

Corrige saltos de línea y espacios no deseados en el texto copiado de un PDF.

Pega o escribe texto copiado de un PDF.

Se actualiza automáticamente. El original sigue disponible.

Cómo funciona y límites de entrada

Pega texto sin formato para limpiarlo automáticamente. Cambiar las opciones actualiza el resultado; al escribir, se actualiza tras una breve pausa. El original se conserva hasta que lo edites o borres.

Límite: 500.000 unidades de código UTF-16, no caracteres visibles. El texto más largo permanece en el editor, pero no se procesa.

El texto se procesa localmente en tu navegador. Esta herramienta no guarda ni sube borradores. Los servicios compartidos del sitio pueden realizar solicitudes de red.

Opciones de limpieza

La reparación de saltos es heurística. Se protegen las líneas vacías y las listas, el código, las tablas y los enlaces aislados reconocidos. Ante un diseño dudoso, usa Solo espacios.

Automático omite el espacio solo entre caracteres Han adyacentes; en los demás casos inserta un espacio. No detecta el idioma.

Pega texto para empezar. La limpieza se inicia automáticamente.

Cómo limpiar texto copiado de PDF

  1. Pega el texto original para iniciar la limpieza automática. Elige reparar párrafos o solo espacios y activa cambios opcionales únicamente cuando los necesites.
  2. Revisa los fragmentos actualizados y decide si cada guion dudoso debe eliminarse, conservarse al unir o dejarse intacto. Cada decisión actualiza el resultado automáticamente.
  3. Copia el resultado cuando termine el procesamiento. Cambiar el texto o las opciones actualiza el resultado y restablece las decisiones sobre guiones; al escribir se espera una breve pausa. Borrar elimina ambos textos y restaura las opciones iniciales.

Qué cambia esta herramienta

Al copiar de un PDF, cada línea visual suele convertirse en una línea de texto. La herramienta une líneas aptas, pero un salto no revela la intención del autor. Conserva párrafos vacíos, listas reconocidas, código delimitado o sangrado, filas tabulares y URL, correos y rutas aislados. La puntuación final de frase también impide la unión. Títulos, poemas y citas no se reconocen perfectamente: revisa o usa Solo espacios.

Un guion al final de línea puede dividir una palabra o pertenecer a un compuesto. Cada aparición tiene su propia decisión y se conserva por defecto. El resultado siempre parte del original actual, sin acumular cambios al restablecer decisiones. Volver a limpiar un resultado puede descubrir nuevas uniones; no se garantiza que la repetición dé el mismo texto.

Automático solo omite espacios entre caracteres Han adyacentes. No detecta idiomas ni deduce todas las separaciones del japonés, coreano, tailandés o jemer. Las opciones se limitan a U+00AD, ff/fi/fl/ffi/ffl, U+00A0/U+202F y espacios ASCII repetidos. Las estructuras protegidas quedan intactas. Se conservan tabulaciones, espacios finales de salto, acentos combinados, emojis, controles de escritura y demás Unicode.

Ejemplos: antes → después

A wrapped ␊ sentence. → A wrapped sentence. (␊ representa un salto de línea sin los espacios de presentación que lo rodean.)

inter-␊national → intacto por defecto; quitar el guion da international y conservarlo da inter-national. state-␊of-the-art → state-of-the-art al conservar el guion.

中文␊文本 → 中文文本 en modo automático. file → file solo al expandir ligaduras. First paragraph.␊␊Second paragraph. conserva ambos saltos.

Procesamiento local y límites

El texto se procesa en el navegador; la herramienta no sube ni guarda borradores. Los servicios compartidos de análisis y publicidad pueden realizar solicitudes de red. Los editores y fragmentos usan los atributos de ocultación del sitio. El límite de 500.000 unidades UTF-16 no cuenta caracteres visibles: un emoji puede ocupar varias unidades. El texto que supera el límite se conserva sin recortes.

Preguntas frecuentes

No. Pega solo texto sin formato. Los PDF escaneados necesitan primero OCR en otra herramienta. No se reconstruyen columnas, tablas ni el orden de lectura perdido. No se eliminan números de página, encabezados repetidos ni citas.

El guion de un compuesto y una división tipográfica pueden parecer idénticos. Ante la duda, conserva el límite original y revisa cada aparición.

Lee las líneas unidas en su contexto. Las herramientas relacionadas de abajo sirven para contar caracteres, medir el tamaño del texto codificado o calcular segmentos SMS.

Contador de caracteres y segmentos SMS

Consulta la codificación, los límites de los segmentos y el posible coste del mensaje. El texto permanece en tu navegador.

Abrir herramientaContador de caracteres y segmentos SMS

Contador de caracteres para redes sociales

Comprueba los límites de cada plataforma y divide publicaciones sin perder texto.

Abrir herramientaContador de caracteres para redes sociales

Contador de caracteres

Cuenta caracteres, palabras, oraciones y párrafos. Revisa la densidad de palabras, el tiempo de lectura y el tamaño UTF-8 en tu navegador.

Abrir herramientaContador de caracteres

Calculadora de tamaño de texto

Compara codificaciones y tamaños de datos de texto en el navegador.

Abrir herramientaCalculadora de tamaño de texto