URL Extractor
Extract all HTTP and HTTPS URLs from text or HTML with deduplication and separator options.
Acerca de esta herramienta
El extractor de URLs escanea cualquier bloque de texto y extrae todas las URLs que comienzan con http:// o https://. Maneja URLs completas con rutas, parámetros de consulta y fragmentos, y elimina la puntuación final.
Incluye opciones para eliminar URLs duplicadas y elegir el separador de salida. Pega HTML, Markdown, logs o cualquier texto y la herramienta extraerá los enlaces. Todo el procesamiento se ejecuta localmente en tu navegador.
Cómo usar
- Pega texto con URLs (HTML, Markdown, logs) en la entrada o haz clic en Muestra.
- Activa Eliminar duplicados para deduplicar URLs idénticas.
- Elige un separador de salida.
- Copia la lista de URLs extraídas.
Casos de uso
Los analistas de SEO extraen todas las URLs del HTML de una página para auditar enlaces. Los desarrolladores obtienen URLs de webhook de archivos de log. Los ingenieros de QA extraen endpoints de API de logs de servidor.
Preguntas frecuentes
- ¿Extrae URLs no HTTP (ftp://, mailto:)? — Actualmente solo se extraen URLs http:// y https://, ya que cubren la gran mayoría de casos de uso.
- ¿Funciona con atributos href de HTML? — Sí. Pega HTML sin procesar y el extractor encontrará URLs en href="...", src="..." y texto en línea.
- ¿Qué pasa con las URLs que contienen paréntesis? — Los paréntesis al final de una URL se eliminan como puntuación final. Las URLs con paréntesis en el medio (como los enlaces de Wikipedia) se extraen correctamente.
- ¿Hay un límite de tamaño? — No. Todo el procesamiento es coincidencia de regex en el navegador y maneja entradas grandes.