PDF-Text bereinigen
Korrigiere unerwünschte Zeilenumbrüche und Leerzeichen in kopiertem PDF-Text.
So bereinigst du kopierten PDF-Text
- Füge den Originaltext ein, um die Bereinigung automatisch zu starten. Wähle Absatzreparatur oder nur Leerzeichen und aktiviere zusätzliche Änderungen nur bei Bedarf.
- Prüfe die aktualisierten Ausschnitte und entscheide bei jedem unklaren Bindestrich: entfernen, beim Verbinden behalten oder unverändert lassen. Jede Entscheidung aktualisiert das Ergebnis automatisch.
- Kopiere das Ergebnis nach der Verarbeitung. Änderungen an Text oder Optionen aktualisieren das Ergebnis und setzen Bindestrichentscheidungen zurück; beim Tippen wird eine kurze Pause abgewartet. Löschen entfernt beide Texte und stellt die Standardeinstellungen wieder her.
Was das Werkzeug ändert
Beim Kopieren aus PDFs entsteht häufig an jedem sichtbaren Zeilenende ein Umbruch. Das Werkzeug verbindet geeignete Zeilen, kann aber aus einem Umbruch nicht die Absicht des Autors erkennen. Leere Absätze, erkannte Listen, abgegrenzter oder eingerückter Code, Tabellenzeilen sowie einzelne URLs, E-Mail-Adressen und Pfade bleiben erhalten. Satzschlusszeichen verhindern ebenfalls eine Verbindung. Überschriften, Gedichte und Zitate werden nicht perfekt erkannt: Prüfe Änderungen oder wähle Nur Leerzeichen.
Ein Bindestrich am Zeilenende kann ein Wort trennen oder zu einem zusammengesetzten Wort gehören. Jedes Vorkommen wird einzeln entschieden und bleibt standardmäßig unverändert. Das Ergebnis entsteht stets aus dem aktuellen Original; das Zurücksetzen häuft keine Änderungen an. Erneutes Bereinigen eines fertigen Ergebnisses kann neue Verbindungen ermöglichen und muss nicht dasselbe Ergebnis liefern.
Automatisch lässt Leerzeichen nur zwischen benachbarten Han-Zeichen weg. Es erkennt keine Sprache und erschließt nicht alle Grenzen in Japanisch, Koreanisch, Thai oder Khmer. Die Optionen betreffen nur U+00AD, ff/fi/fl/ffi/ffl, U+00A0/U+202F und wiederholte ASCII-Leerzeichen. Geschützte Strukturen bleiben exakt erhalten. Tabulatoren, abschließende Leerzeichen für harte Umbrüche, kombinierende Akzente, Emojis, Schriftsteuerzeichen und anderes Unicode bleiben unverändert.
Beispiele: vorher → nachher
A wrapped ␊ sentence. → A wrapped sentence. (␊ steht für einen Zeilenumbruch ohne die umgebenden Darstellungsleerzeichen.)
inter-␊national → standardmäßig unverändert; Entfernen ergibt international, Beibehalten inter-national. state-␊of-the-art → state-of-the-art beim Beibehalten des Bindestrichs.
中文␊文本 → 中文文本 im Automatikmodus. file → file nur mit Ligaturauflösung. First paragraph.␊␊Second paragraph. behält beide Umbrüche.
Lokale Verarbeitung und Grenzen
Die Verarbeitung erfolgt im Browser; das Werkzeug überträgt oder speichert keine Entwürfe. Gemeinsame Analyse- und Werbedienste können Netzwerkanfragen stellen. Editoren und Prüfausschnitte verwenden die Maskierungsattribute der Website. Das Limit von 500.000 UTF-16-Einheiten zählt keine sichtbaren Zeichen: Emojis können mehrere Einheiten belegen. Zu langer Text bleibt ungekürzt erhalten.
Häufige Fragen
Ähnliche Werkzeuge
SMS-Zeichen- und Segmentzähler
Sieh, wie deine Nachricht kodiert wird, wo Segmente enden und was sie kosten könnte. Dein Text bleibt im Browser.
Werkzeug öffnen — SMS-Zeichen- und SegmentzählerZeichenzähler für soziale Medien
Prüfe Plattformlimits und teile Beiträge ohne Textverlust auf.
Werkzeug öffnen — Zeichenzähler für soziale MedienZeichenzähler
Zählen Sie Zeichen, Wörter, Sätze und Absätze. Prüfen Sie Wortdichte, geschätzte Lesezeit und UTF-8-Größe direkt im Browser.
Werkzeug öffnen — ZeichenzählerTextgrößenrechner
Vergleichen Sie Textkodierungen und die Größe übertragener Textdaten im Browser.
Werkzeug öffnen — Textgrößenrechner