Doppelte Zeilen aus Text entfernen: Anleitung
Fügen Sie den mehrzeiligen Text ein, wählen Sie **Remove**, **Extract** oder **Highlight** und starten Sie die Verarbeitung. Ohne abweichende Auswahl entfernt der Standardmodus spätere Wiederholungen und behält die erste erfasste Position bei.
Fügen Sie den mehrzeiligen Text ein, wählen Sie Remove, Extract oder Highlight und starten Sie die Verarbeitung. Ohne abweichende Auswahl entfernt der Standardmodus spätere Wiederholungen und behält die erste erfasste Position bei.
Wofür die zeilenweise Duplikatprüfung geeignet ist
Der Duplicate Line Remover untersucht einen mehrzeiligen Text Zeile für Zeile und hilft dabei, wiederholte Einträge je nach Ziel anders zu behandeln. Sie können spätere Wiederholungen aus der Ausgabe entfernen, je einen passenden Vertreter ausgeben oder betroffene Zeilenpositionen kennzeichnen. Damit eignet sich das Werkzeug zum Aufräumen von Listen, kopierten Notizen und anderen Texten mit einer Zeile pro Eintrag. Die Eingabe ist optional: Wenn Sie keinen Text bereitstellen, wird leerer Text verarbeitet und es werden keine Duplikate gefunden.
Für die Wahl des Ergebnisses ist entscheidend, was mit den Wiederholungen geschehen soll. Remove verkürzt den ausgegebenen Text, Extract stellt Vertreter der Vergleichswerte zusammen und Highlight macht markierte Positionen sichtbar, ohne sie auf dieselbe Weise zu entfernen. Die drei Varianten arbeiten auf derselben zeilenweisen Grundlage, führen aber zu unterschiedlichen Ausgabeformen.
Modus, Vergleich und Ausgabe Schritt für Schritt festlegen
- Fügen Sie den mehrzeiligen Inhalt in das Eingabefeld ein. Trennen Sie Einträge mit Zeilenumbrüchen, wenn jeder Eintrag als eigene Zeile geprüft werden soll. Sie können das Feld auch leer lassen; in diesem Fall ist eine erfolgreiche Verarbeitung ohne gefundene Duplikate vorgesehen.
- Wählen Sie den Modus passend zu Ihrer Aufgabe. Mit Remove lassen Sie spätere Wiederholungspositionen aus dem Ergebnis weg. Extract gibt einen Vertreter für jeden Duplikat-Vergleichswert aus und ordnet diese Vertreter nach ihrem ersten Auftreten. Highlight versieht als Duplikate markierte Zeilenpositionen mit
>>, während andere Zeilen ohne dieses Präfix bleiben. - Legen Sie fest, ob die Groß- und Kleinschreibung beim Vergleich berücksichtigt werden soll. In der Standardeinstellung werden die Zeilen für den Vergleich in Kleinbuchstaben umgewandelt. Wenn Sie die Unterscheidung aktivieren, können unterschiedliche Schreibweisen zu verschiedenen Vergleichswerten führen.
- Prüfen Sie bei Remove, ob die Option zum Beibehalten der ersten erfassten Position aktiviert bleiben soll. Diese Einstellung ist standardmäßig vorgesehen. Deaktivieren oder ändern Sie sie nur, wenn die Reihenfolge der behaltenen Positionen für Ihre Aufgabe anders behandelt werden soll.
- Starten Sie die Verarbeitung und lesen Sie die Ausgabe anhand des gewählten Modus. Vergleichen Sie bei einer bereinigten Liste besonders die Reihenfolge und die Zahl der verbliebenen Zeilen mit Ihrer Eingabe. Bei einer Markierung dient das Präfix zur Orientierung, nicht zum Löschen des jeweiligen Zeilentexts.
Die verschiedenen Ergebnisformen korrekt einordnen
Eine Zeile wird am Zeilenumbruch abgegrenzt. Für den Vergleich wird der vollständige Zeilentext verwendet; führende oder nachgestellte Leerzeichen werden nicht automatisch entfernt. Deshalb können zwei inhaltlich ähnlich wirkende Einträge als verschieden gelten, wenn sich ihre Leerzeichen unterscheiden. Die Schreibweise allein muss dagegen nicht zu einer Trennung führen, solange die Groß-/Kleinschreibung nicht berücksichtigt wird.
Wenn Sie keine andere Auswahl treffen, arbeitet das Werkzeug im Modus Remove. Dort bleiben nach der Standardeinstellung die erste erfasste Position und ihre Zeile erhalten, während spätere Wiederholungspositionen in der Ausgabe fehlen. Das Ergebnis von Extract ist keine vollständige Kopie aller Eingabezeilen, sondern eine Folge ausgewählter Vertreter in der Reihenfolge, in der ihre Vergleichswerte erstmals erscheinen. Highlight liefert dagegen weiterhin die Zeilen und kennzeichnet die Positionen, die als Duplikate markiert wurden.
Ein Moduswert außerhalb von Remove, Extract und Highlight führt nicht zu einer zusätzlichen Duplikatfunktion: Die Verarbeitung gelingt und gibt den Eingabetext unverändert zurück. Kontrollieren Sie deshalb die Modusauswahl, bevor Sie ein Ergebnis weiterverwenden.
Praktisches Beispiel
Sie bereinigen eine vierzeilige Liste, in der „Alpha“ an einer späteren Position nochmals vorkommt.
Fügen Sie beispielsweise „Alpha“, „Beta“, „Alpha“ und „Gamma“ als vier getrennte Zeilen ein, lassen Sie Remove sowie das Beibehalten der ersten Position ausgewählt und starten Sie die Verarbeitung.
Bei vier Eingabezeilen mit einer späteren Wiederholung enthält die Remove-Ausgabe drei Zeilen; die erste Position des wiederholten Eintrags bleibt erhalten.
Einschränkungen
- Führende und nachgestellte Leerzeichen werden nicht automatisch entfernt, weil der Vergleich den vollständigen Zeilentext verwendet.
- Die beschriebenen Duplikatfunktionen gelten für Remove, Extract und Highlight; ein anderer Modus gibt den Eingabetext unverändert zurück.
Häufige Fehler
- Ursache: Die betroffenen Einträge unterscheiden sich entweder in der vollständigen Zeile, etwa durch zusätzliche Leerzeichen, oder die Einstellung für die Groß-/Kleinschreibung passt nicht zur erwarteten Zusammenfassung. Korrektur: Vereinheitlichen Sie die Zeilenumbrüche und prüfen Sie die Schreibweise, bevor Sie die Vergleichseinstellung erneut festlegen.
Häufige Fragen
Werden „Berlin“ und „berlin“ als doppelte Zeilen erkannt?
Das hängt von der Vergleichseinstellung ab. In der Standardeinstellung werden die Zeilen für den Vergleich in Kleinbuchstaben umgewandelt, sodass die beiden Schreibweisen denselben Vergleichswert bilden können. Bei aktivierter Unterscheidung der Groß- und Kleinschreibung werden sie als verschiedene Vergleichswerte behandelt.
Welche doppelte Zeile bleibt beim Entfernen erhalten?
Bei der vorgesehenen Standardeinstellung für Remove bleibt die zuerst erfasste Position bestehen. Eine später erneut auftretende Position wird aus dem resultierenden Text weggelassen.
Was passiert ohne Eingabetext?
Wenn kein Text eingegeben wird, verarbeitet das Werkzeug eine leere Eingabe erfolgreich. Das Ergebnis weist dabei keine gefundenen Duplikate auf.