TL
Tool Lab
💰Donate
💰Donate

URL Extractor

Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.

Tekst wejściowy
Separator:

O tym narzędziu

Ekstraktor URL skanuje dowolny blok tekstu i wyodrębnia wszystkie adresy URL zaczynające się od http:// lub https://. Obsługuje pełne adresy URL z ścieżkami, parametrami zapytań i fragmentami, usuwając końcową interpunkcję.

Zawiera opcje usuwania zduplikowanych URL i wyboru separatora wyjściowego. Wklej HTML, Markdown, logi lub dowolny tekst — narzędzie wyodrębni linki. Całe przetwarzanie odbywa się lokalnie w przeglądarce.

Jak używać

  1. Wklej tekst z adresami URL do pola wejściowego lub kliknij Przykład.
  2. Włącz Usuń duplikaty, aby zdeduplikować identyczne adresy URL.
  3. Wybierz separator wyjściowy.
  4. Skopiuj wyodrębnioną listę adresów URL.

Przypadki użycia

Analitycy SEO wyodrębniają wszystkie adresy URL z HTML strony, aby audytować linki. Programiści pobierają adresy URL webhooków z plików dziennika. Inżynierowie QA wyodrębniają endpointy API z logów serwera.

Często zadawane pytania

  • Czy wyodrębnia URL inne niż HTTP (ftp://, mailto:)?Obecnie wyodrębniane są tylko adresy URL http:// i https://, ponieważ obejmują one zdecydowaną większość przypadków użycia.
  • Czy działa z atrybutami href HTML?Tak. Wklej surowy HTML, a ekstraktor znajdzie adresy URL w href="...", src="..." i tekście inline.
  • Co jeśli adres URL zawiera nawiasy?Nawiasy na końcu adresu URL są usuwane jako końcowa interpunkcja. Adresy URL z nawiasami w środku (jak linki Wikipedii) są poprawnie wyodrębniane.
  • Czy jest ograniczenie rozmiaru?Nie. Całe przetwarzanie to dopasowywanie regex po stronie przeglądarki, które obsługuje duże dane wejściowe.