URL Extractor
Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.
Texto de entrada
Separador:
Sobre esta ferramenta
O extrator de URLs escaneia qualquer bloco de texto e extrai todas as URLs começando com http:// ou https://. Processa URLs completas com caminhos, parâmetros de consulta e fragmentos, removendo pontuação final.
Inclui opções para remover URLs duplicadas e escolher o separador de saída. Cole HTML, Markdown, logs ou qualquer texto e a ferramenta extrairá os links. Todo o processamento ocorre localmente no seu navegador.
Como usar
- Cole texto com URLs (HTML, Markdown, logs) na entrada ou clique em Amostra.
- Ative Remover duplicatas para deduplicar URLs idênticas.
- Escolha um separador de saída.
- Copie a lista de URLs extraídas.
Casos de uso
Analistas de SEO extraem todas as URLs do HTML de uma página para auditar links. Desenvolvedores obtêm URLs de webhook de arquivos de log. Engenheiros de QA extraem endpoints de API de logs de servidor.
Perguntas frequentes
- Extrai URLs não HTTP (ftp://, mailto:)? — Atualmente apenas URLs http:// e https:// são extraídas, pois cobrem a grande maioria dos casos de uso.
- Funciona com atributos href do HTML? — Sim. Cole HTML bruto e o extrator encontrará URLs em href="...", src="..." e texto inline.
- E se uma URL contiver parênteses? — Parênteses no final de uma URL são removidos como pontuação final. URLs com parênteses no meio (como links da Wikipedia) são extraídas corretamente.
- Há um limite de tamanho? — Não. Todo o processamento é correspondência de regex no navegador e lida com entradas grandes.