URL Extractor
Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.
Tekst wejściowy
Separator:
O tym narzędziu
Ekstraktor URL skanuje dowolny blok tekstu i wyodrębnia wszystkie adresy URL zaczynające się od http:// lub https://. Obsługuje pełne adresy URL z ścieżkami, parametrami zapytań i fragmentami, usuwając końcową interpunkcję.
Zawiera opcje usuwania zduplikowanych URL i wyboru separatora wyjściowego. Wklej HTML, Markdown, logi lub dowolny tekst — narzędzie wyodrębni linki. Całe przetwarzanie odbywa się lokalnie w przeglądarce.
Jak używać
- Wklej tekst z adresami URL do pola wejściowego lub kliknij Przykład.
- Włącz Usuń duplikaty, aby zdeduplikować identyczne adresy URL.
- Wybierz separator wyjściowy.
- Skopiuj wyodrębnioną listę adresów URL.
Przypadki użycia
Analitycy SEO wyodrębniają wszystkie adresy URL z HTML strony, aby audytować linki. Programiści pobierają adresy URL webhooków z plików dziennika. Inżynierowie QA wyodrębniają endpointy API z logów serwera.
Często zadawane pytania
- Czy wyodrębnia URL inne niż HTTP (ftp://, mailto:)? — Obecnie wyodrębniane są tylko adresy URL http:// i https://, ponieważ obejmują one zdecydowaną większość przypadków użycia.
- Czy działa z atrybutami href HTML? — Tak. Wklej surowy HTML, a ekstraktor znajdzie adresy URL w href="...", src="..." i tekście inline.
- Co jeśli adres URL zawiera nawiasy? — Nawiasy na końcu adresu URL są usuwane jako końcowa interpunkcja. Adresy URL z nawiasami w środku (jak linki Wikipedii) są poprawnie wyodrębniane.
- Czy jest ograniczenie rozmiaru? — Nie. Całe przetwarzanie to dopasowywanie regex po stronie przeglądarki, które obsługuje duże dane wejściowe.