Limpieza de texto de PDF
Corrige saltos de línea y espacios no deseados en el texto copiado de un PDF.
Cómo limpiar texto copiado de PDF
- Pega el texto original para iniciar la limpieza automática. Elige reparar párrafos o solo espacios y activa cambios opcionales únicamente cuando los necesites.
- Revisa los fragmentos actualizados y decide si cada guion dudoso debe eliminarse, conservarse al unir o dejarse intacto. Cada decisión actualiza el resultado automáticamente.
- Copia el resultado cuando termine el procesamiento. Cambiar el texto o las opciones actualiza el resultado y restablece las decisiones sobre guiones; al escribir se espera una breve pausa. Borrar elimina ambos textos y restaura las opciones iniciales.
Qué cambia esta herramienta
Al copiar de un PDF, cada línea visual suele convertirse en una línea de texto. La herramienta une líneas aptas, pero un salto no revela la intención del autor. Conserva párrafos vacíos, listas reconocidas, código delimitado o sangrado, filas tabulares y URL, correos y rutas aislados. La puntuación final de frase también impide la unión. Títulos, poemas y citas no se reconocen perfectamente: revisa o usa Solo espacios.
Un guion al final de línea puede dividir una palabra o pertenecer a un compuesto. Cada aparición tiene su propia decisión y se conserva por defecto. El resultado siempre parte del original actual, sin acumular cambios al restablecer decisiones. Volver a limpiar un resultado puede descubrir nuevas uniones; no se garantiza que la repetición dé el mismo texto.
Automático solo omite espacios entre caracteres Han adyacentes. No detecta idiomas ni deduce todas las separaciones del japonés, coreano, tailandés o jemer. Las opciones se limitan a U+00AD, ff/fi/fl/ffi/ffl, U+00A0/U+202F y espacios ASCII repetidos. Las estructuras protegidas quedan intactas. Se conservan tabulaciones, espacios finales de salto, acentos combinados, emojis, controles de escritura y demás Unicode.
Ejemplos: antes → después
A wrapped ␊ sentence. → A wrapped sentence. (␊ representa un salto de línea sin los espacios de presentación que lo rodean.)
inter-␊national → intacto por defecto; quitar el guion da international y conservarlo da inter-national. state-␊of-the-art → state-of-the-art al conservar el guion.
中文␊文本 → 中文文本 en modo automático. file → file solo al expandir ligaduras. First paragraph.␊␊Second paragraph. conserva ambos saltos.
Procesamiento local y límites
El texto se procesa en el navegador; la herramienta no sube ni guarda borradores. Los servicios compartidos de análisis y publicidad pueden realizar solicitudes de red. Los editores y fragmentos usan los atributos de ocultación del sitio. El límite de 500.000 unidades UTF-16 no cuenta caracteres visibles: un emoji puede ocupar varias unidades. El texto que supera el límite se conserva sin recortes.
Preguntas frecuentes
Herramientas relacionadas
Contador de caracteres y segmentos SMS
Consulta la codificación, los límites de los segmentos y el posible coste del mensaje. El texto permanece en tu navegador.
Abrir herramienta — Contador de caracteres y segmentos SMSContador de caracteres para redes sociales
Comprueba los límites de cada plataforma y divide publicaciones sin perder texto.
Abrir herramienta — Contador de caracteres para redes socialesContador de caracteres
Cuenta caracteres, palabras, oraciones y párrafos. Revisa la densidad de palabras, el tiempo de lectura y el tamaño UTF-8 en tu navegador.
Abrir herramienta — Contador de caracteresCalculadora de tamaño de texto
Compara codificaciones y tamaños de datos de texto en el navegador.
Abrir herramienta — Calculadora de tamaño de texto