TL
Tool Lab
💰Donate
💰Donate

URL Extractor

Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.

Inmatningstext
Avgränsare:

Om det här verktyget

URL-extraheraren skannar valfritt textblock och extraherar alla URL:er som börjar med http:// eller https://. Den hanterar fullständiga URL:er inklusive sökvägar, frågeparametrar och fragment, och tar bort avslutande skiljetecken.

Inkluderar alternativ för att ta bort duplicerade URL:er och välja utdataavgränsare. Klistra in HTML, Markdown, loggar eller valfri text och verktyget extraherar länkarna. All bearbetning sker lokalt i webbläsaren.

Hur man använder

  1. Klistra in text med URL:er i inmatningen eller klicka på Exempel.
  2. Aktivera Ta bort dubbletter för att deduplicera identiska URL:er.
  3. Välj en utdataavgränsare.
  4. Kopiera den extraherade URL-listan.

Användningsfall

SEO-analytiker extraherar alla URL:er från en sidas HTML för att granska länkar. Utvecklare hämtar webhook-URL:er från loggfiler. QA-ingenjörer extraherar API-slutpunkter från serverloggar för testning.

Vanliga frågor

  • Extraherar den icke-HTTP-URL:er (ftp://, mailto:)?För närvarande extraheras bara http:// och https://-URL:er, eftersom de täcker den stora majoriteten av användningsfall.
  • Fungerar det med HTML href-attribut?Ja. Klistra in rå HTML och extraheraren hittar URL:er i href="...", src="..." och inline-text.
  • Vad händer om en URL innehåller parenteser?Parenteser i slutet av en URL tas bort som avslutande skiljetecken. URL:er med parenteser i mitten (som Wikipedia-länkar) extraheras korrekt.
  • Finns det en storleksgräns?Nej. All bearbetning är regex-matchning på webbläsarsidan och hanterar stora inmatningar.