I luoghi preferiti della tua città preferita
Pagina Iniziale
Aggiungi alle fonti preferite su Google

Pulizia del testo da PDF

Correggi a capo e spazi indesiderati nel testo copiato da un PDF.

Incolla o digita il testo copiato da un PDF.

Si aggiorna automaticamente. L’originale resta disponibile.

Come funziona e limiti di input

Incolla testo semplice per pulirlo automaticamente. Le impostazioni aggiornano il risultato; durante la digitazione, l’aggiornamento avviene dopo una breve pausa. L’originale resta disponibile finché non lo modifichi o cancelli.

Limite: 500.000 unità di codice UTF-16, non caratteri visibili. Il testo più lungo resta nell’editor ma non può essere elaborato.

Il testo viene elaborato localmente nel browser. Questo strumento non salva né carica le bozze. I servizi condivisi del sito possono effettuare richieste di rete.

Impostazioni di pulizia

La riparazione degli a capo usa regole euristiche. Righe vuote, elenchi, codice, tabelle e link isolati riconosciuti sono protetti. Nei casi dubbi usa Solo spazi.

Automatico omette lo spazio solo tra caratteri Han adiacenti; negli altri casi inserisce uno spazio. Non riconosce la lingua.

Incolla il testo per iniziare. La pulizia parte automaticamente.

Come pulire il testo copiato da PDF

  1. Incolla il testo originale per avviare la pulizia automatica. Scegli la riparazione dei paragrafi o solo gli spazi e attiva le modifiche facoltative quando servono.
  2. Controlla gli estratti aggiornati e decidi se ogni trattino dubbio va rimosso, mantenuto nell’unione o lasciato invariato. Ogni scelta aggiorna automaticamente il risultato.
  3. Copia il risultato al termine dell’elaborazione. Modificare testo o opzioni aggiorna il risultato e azzera le scelte sui trattini; durante la digitazione si attende una breve pausa. La cancellazione elimina entrambi i testi e ripristina le impostazioni iniziali.

Cosa modifica lo strumento

Copiando da un PDF si ottiene spesso un a capo per ogni riga visuale. Questo strumento unisce le righe ammesse, ma un a capo non rivela l’intenzione dell’autore. Conserva paragrafi vuoti, elenchi riconosciuti, codice delimitato o indentato, righe tabulari e URL, email e percorsi isolati. Anche la punteggiatura di fine frase impedisce l’unione. Titoli, poesie e citazioni non sono riconosciuti perfettamente: controlla o usa Solo spazi.

Un trattino a fine riga può dividere una parola o appartenere a un composto. Ogni occorrenza ha una scelta indipendente e resta invariata per impostazione predefinita. Il risultato parte sempre dall’originale attuale, senza accumulare modifiche quando reimposti le scelte. Ripulire un risultato già pulito può far emergere nuove unioni: non è garantito lo stesso risultato.

Automatico omette spazi solo tra caratteri Han adiacenti. Non riconosce la lingua né tutte le separazioni in giapponese, coreano, thailandese o khmer. Le opzioni riguardano solo U+00AD, ff/fi/fl/ffi/ffl, U+00A0/U+202F e spazi ASCII ripetuti. Le strutture protette restano identiche. Tabulazioni, spazi finali di interruzione, accenti combinanti, emoji, controlli di scrittura e altri caratteri Unicode vengono conservati.

Esempi: prima → dopo

A wrapped ␊ sentence. → A wrapped sentence. (␊ indica un a capo, senza gli spazi usati qui per la presentazione.)

inter-␊national → invariato per impostazione predefinita; rimuovendo il trattino si ottiene international, mantenendolo inter-national. state-␊of-the-art → state-of-the-art mantenendo il trattino.

中文␊文本 → 中文文本 in modalità automatica. file → file solo espandendo le legature. First paragraph.␊␊Second paragraph. conserva entrambi gli a capo.

Elaborazione locale e limiti

Il testo viene elaborato nel browser: lo strumento non carica né salva bozze. I servizi condivisi di analisi e pubblicità possono effettuare richieste di rete. Editor ed estratti usano gli attributi di mascheramento del sito. Il limite di 500.000 unità UTF-16 non conta i caratteri visibili: un’emoji può occupare più unità. Il testo oltre il limite resta integro.

Domande frequenti

No. Incolla solo testo semplice. I PDF scansionati richiedono prima un OCR esterno. Non si possono ricostruire colonne, tabelle o ordine di lettura perduti. Numeri di pagina, intestazioni ripetute e citazioni non vengono rimossi.

Il trattino di un composto e una divisione tipografica possono apparire identici. Nel dubbio conserva l’interruzione originale e controlla ogni occorrenza.

Rileggi nel contesto le righe unite. Gli strumenti correlati qui sotto permettono di contare i caratteri, misurare la dimensione del testo codificato o calcolare i segmenti SMS.

Contatore di caratteri e segmenti SMS

Scopri la codifica del messaggio, i confini dei segmenti e il possibile costo. Il testo rimane nel tuo browser.

Apri strumentoContatore di caratteri e segmenti SMS

Contatore di caratteri per social media

Verifica i limiti delle piattaforme e dividi i post senza perdere testo.

Apri strumentoContatore di caratteri per social media

Contatore di caratteri

Conta caratteri, parole, frasi e paragrafi. Controlla densità delle parole, tempo di lettura e dimensione UTF-8 nel browser.

Apri strumentoContatore di caratteri

Calcolatore della dimensione del testo

Confronta codifiche e dimensioni dei dati di testo nel browser.

Apri strumentoCalcolatore della dimensione del testo