URL Extractor
Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.
Inmatningstext
Avgränsare:
Om det här verktyget
URL-extraheraren skannar valfritt textblock och extraherar alla URL:er som börjar med http:// eller https://. Den hanterar fullständiga URL:er inklusive sökvägar, frågeparametrar och fragment, och tar bort avslutande skiljetecken.
Inkluderar alternativ för att ta bort duplicerade URL:er och välja utdataavgränsare. Klistra in HTML, Markdown, loggar eller valfri text och verktyget extraherar länkarna. All bearbetning sker lokalt i webbläsaren.
Hur man använder
- Klistra in text med URL:er i inmatningen eller klicka på Exempel.
- Aktivera Ta bort dubbletter för att deduplicera identiska URL:er.
- Välj en utdataavgränsare.
- Kopiera den extraherade URL-listan.
Användningsfall
SEO-analytiker extraherar alla URL:er från en sidas HTML för att granska länkar. Utvecklare hämtar webhook-URL:er från loggfiler. QA-ingenjörer extraherar API-slutpunkter från serverloggar för testning.
Vanliga frågor
- Extraherar den icke-HTTP-URL:er (ftp://, mailto:)? — För närvarande extraheras bara http:// och https://-URL:er, eftersom de täcker den stora majoriteten av användningsfall.
- Fungerar det med HTML href-attribut? — Ja. Klistra in rå HTML och extraheraren hittar URL:er i href="...", src="..." och inline-text.
- Vad händer om en URL innehåller parenteser? — Parenteser i slutet av en URL tas bort som avslutande skiljetecken. URL:er med parenteser i mitten (som Wikipedia-länkar) extraheras korrekt.
- Finns det en storleksgräns? — Nej. All bearbetning är regex-matchning på webbläsarsidan och hanterar stora inmatningar.