URL Extractor
Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.
À propos de cet outil
L'extracteur d'URLs scanne tout bloc de texte et extrait toutes les URLs commençant par http:// ou https://. Il gère les URLs complètes avec chemins, paramètres de requête et fragments, et supprime la ponctuation finale.
Comprend des options pour supprimer les URLs en double et choisir le séparateur de sortie. Collez du HTML, Markdown, des logs ou tout texte et l'outil extraira les liens. Tout le traitement s'exécute localement.
Comment utiliser
- Collez du texte avec des URLs (HTML, Markdown, logs) dans la saisie ou cliquez sur Exemple.
- Activez Supprimer les doublons pour dédupliquer les URLs identiques.
- Choisissez un séparateur de sortie.
- Copiez la liste d'URLs extraites.
Cas d'utilisation
Les analystes SEO extraient toutes les URLs du HTML d'une page pour auditer les liens. Les développeurs récupèrent les URLs de webhook depuis les fichiers journaux. Les ingénieurs QA extraient les endpoints API des logs serveur.
Questions fréquentes
- Extrait-il les URLs non HTTP (ftp://, mailto:) ? — Actuellement seules les URLs http:// et https:// sont extraites, car elles couvrent la grande majorité des cas d'usage.
- Fonctionne-t-il avec les attributs href HTML ? — Oui. Collez du HTML brut et l'extracteur trouvera des URLs dans href="...", src="..." et le texte en ligne.
- Que se passe-t-il si une URL contient des parenthèses ? — Les parenthèses en fin d'URL sont supprimées comme ponctuation finale. Les URLs avec des parenthèses au milieu (comme les liens Wikipedia) sont extraites correctement.
- Y a-t-il une limite de taille ? — Non. Tout le traitement est une correspondance regex côté navigateur et gère les grandes entrées.