URL Extractor
Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.
Über dieses Tool
Der URL-Extraktor scannt jeden Textblock und extrahiert alle URLs, die mit http:// oder https:// beginnen. Er verarbeitet vollständige URLs mit Pfaden, Abfrageparametern und Fragmenten und entfernt abschließende Satzzeichen.
Enthält Optionen zum Entfernen doppelter URLs und zur Auswahl des Ausgabe-Trennzeichens. HTML, Markdown, Logs oder beliebigen Text einfügen und das Tool extrahiert die Links. Die gesamte Verarbeitung erfolgt lokal im Browser.
Anleitung
- Text mit URLs (HTML, Markdown, Logs) in die Eingabe einfügen oder auf Beispiel klicken.
- Duplikate entfernen aktivieren, um identische URLs zu deduplizieren.
- Ein Ausgabe-Trennzeichen wählen.
- Die extrahierte URL-Liste kopieren.
Anwendungsfälle
SEO-Analysten extrahieren alle URLs aus dem HTML einer Seite, um Links zu prüfen. Entwickler holen Webhook-URLs aus Konfigurationsexporten oder Log-Dateien. QA-Ingenieure extrahieren API-Endpunkte aus Server-Logs.
Häufige Fragen
- Werden Nicht-HTTP-URLs (ftp://, mailto:) extrahiert? — Derzeit werden nur http:// und https://-URLs extrahiert, da diese die große Mehrheit der Anwendungsfälle abdecken.
- Funktioniert es mit HTML href-Attributen? — Ja. Rohes HTML einfügen und der Extraktor findet URLs in href="...", src="..." und Inline-Text.
- Was, wenn eine URL Klammern enthält? — Klammern am Ende einer URL werden als nachfolgende Satzzeichen entfernt. URLs mit Klammern in der Mitte (wie Wikipedia-Links) werden korrekt extrahiert.
- Gibt es eine Größenbeschränkung? — Nein. Die gesamte Verarbeitung ist browser-seitiges Regex-Matching und verarbeitet große Eingaben.