TL
Tool Lab
💰Spenden
💰Spenden

URL Extractor

Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.

Eingabetext
Trennzeichen:

Über dieses Tool

Der URL-Extraktor scannt jeden Textblock und extrahiert alle URLs, die mit http:// oder https:// beginnen. Er verarbeitet vollständige URLs mit Pfaden, Abfrageparametern und Fragmenten und entfernt abschließende Satzzeichen.

Enthält Optionen zum Entfernen doppelter URLs und zur Auswahl des Ausgabe-Trennzeichens. HTML, Markdown, Logs oder beliebigen Text einfügen und das Tool extrahiert die Links. Die gesamte Verarbeitung erfolgt lokal im Browser.

Anleitung

  1. Text mit URLs (HTML, Markdown, Logs) in die Eingabe einfügen oder auf Beispiel klicken.
  2. Duplikate entfernen aktivieren, um identische URLs zu deduplizieren.
  3. Ein Ausgabe-Trennzeichen wählen.
  4. Die extrahierte URL-Liste kopieren.

Anwendungsfälle

SEO-Analysten extrahieren alle URLs aus dem HTML einer Seite, um Links zu prüfen. Entwickler holen Webhook-URLs aus Konfigurationsexporten oder Log-Dateien. QA-Ingenieure extrahieren API-Endpunkte aus Server-Logs.

Häufige Fragen

  • Werden Nicht-HTTP-URLs (ftp://, mailto:) extrahiert?Derzeit werden nur http:// und https://-URLs extrahiert, da diese die große Mehrheit der Anwendungsfälle abdecken.
  • Funktioniert es mit HTML href-Attributen?Ja. Rohes HTML einfügen und der Extraktor findet URLs in href="...", src="..." und Inline-Text.
  • Was, wenn eine URL Klammern enthält?Klammern am Ende einer URL werden als nachfolgende Satzzeichen entfernt. URLs mit Klammern in der Mitte (wie Wikipedia-Links) werden korrekt extrahiert.
  • Gibt es eine Größenbeschränkung?Nein. Die gesamte Verarbeitung ist browser-seitiges Regex-Matching und verarbeitet große Eingaben.