Über das Extrahieren von Adressen aus Text
Die Eingabe ist nie ordentlich. Es ist ein weitergeleiteter E-Mail-Verlauf mit vierzig Adressen in den Kopfzeilen, eine Seite HTML, eine Protokolldatei, eine schlecht exportierte CSV, ein Chat-Export. Die Adressen stecken darin, umgeben von spitzen Klammern, mailto: und Punkten, die zum Satz gehören und nicht zur Adresse.
Einfügen und eine saubere Liste zurückbekommen. Nichts wird hochgeladen — der Text verlässt Ihren Browser nie, was zählt, wenn es sich um eine Kundenliste oder einen E-Mail-Verlauf handelt.
Es weiß, wo eine Adresse endet
Das ist der Punkt, der einen brauchbaren Extraktor von einem irgendwo gefundenen regulären Ausdruck unterscheidet.
- Ein abschließendes . , ; : ) ] > " ' ist Satzzeichen und nicht Teil der Adresse. „Schreiben Sie an bob@example.com." ergibt bob@example.com, keine Adresse mit angeklebtem Punkt
- Eine schließende Klammer gehört nur dann zu einer URL, wenn diese URL selbst eine geöffnet hat. (siehe https://example.com/a) endet beim a, aber https://de.wikipedia.org/wiki/Foo_(bar) behält seine Klammer
- mailto: und spitze Klammern sind Umschlag, nicht Adresse, und werden entfernt
- Telefonnummern werden über die Länge begrenzt statt über die Form — 7 bis 15 Ziffern, der tatsächliche weltweite Bereich für Rufnummern. Internationale Formate schwanken zu stark, um streng zu sein, ohne echte Nummern zu verlieren
So wird es benutzt
- Text einfügen oder eine Datei laden — auch eine Tabelle, in der die Adressen über Zellen verstreut sind statt in einer Spalte zu stehen
- E-Mails, Links oder Telefonnummern wählen
- Duplikate entfernen eingeschaltet lassen, sofern Sie nicht die Rohanzahl brauchen. Dieselbe Adresse vierzigmal in einem Verlauf ist eine Adresse
- Die Ausgabeform wählen: eine pro Zeile, kommagetrennt zum Einfügen in ein An-Feld, oder Semikolons für Outlook
- Die Liste kopieren oder als CSV herunterladen
Die Anzeige nennt beide Zahlen — wie viele gefunden und wie viele Duplikate zusammengefasst wurden — damit nichts verloren wirkt.
Wofür es genutzt wird
- Alle Adressen aus einem weitergeleiteten Verlauf holen, um einen Verteiler aufzubauen
- Die Links aus einer Seite oder einem Dokument ziehen, um sie zu prüfen
- Kontaktdaten aus einem ausgelesenen oder exportierten Textklumpen herausholen
- Alle Adressen finden, die in einer Tabelle ohne einheitliche Spalte vergraben sind
- Telefonnummern aus einer Liste von Anfragen sammeln
- Vor dem Teilen prüfen, ob ein Dokument Adressen enthält, die Sie dort nicht erwartet haben
Gut zu wissen
- Läuft überall — es ist eine Webseite und funktioniert daher auf jedem Handy, Tablet oder Rechner
- Nichts wird hochgeladen. Der Text wird vollständig in Ihrem Browser durchsucht
- Kleinschreibung ist bei E-Mails eingeschaltet, weil der lokale Teil in der Praxis nicht zwischen Groß- und Kleinschreibung unterscheidet und Bob@ und bob@ eine Adresse sind. Bei Telefonnummern entfällt es, dort hat Schreibweise keine Bedeutung
- Beim Laden einer Tabelle werden alle Blätter gelesen, sodass auch eine Adresse in einem vergessenen Reiter gefunden wird
- Dies ist ein Text-Extraktor, kein Prüfwerkzeug. Es findet, was wie eine Adresse aussieht; es prüft nicht, ob sie existiert oder ob jemand sie liest
- Bitte gehen Sie mit dem Ergebnis verantwortungsvoll um. Adressen aus fremden Dokumenten zu sammeln, um unerwünschte Post zu versenden, ist in den meisten Ländern nach Anti-Spam- und Datenschutzrecht unzulässig
Verwandte Werkzeuge
- Text in Dateien suchen — einen ganzen Ordner durchsuchen statt eines Textblocks
- Doppelte Zeilen entfernen — eine beliebige Textliste bereinigen
- Liste sortieren & alphabetisch ordnen — das Ergebnis neu ordnen
- Regex-Tester — ein eigenes Muster für das bauen, was hier nicht abgedeckt ist