Convertisseur HTML en texte brut
Supprimez les balises HTML et extrayez du texte brut lisible de n'importe quel HTML.
À propos de cet outil
Le convertisseur HTML en texte brut supprime toutes les balises HTML d'un document et renvoie le contenu textuel lisible. Les entités HTML comme &, < et   sont automatiquement décodées.
Avec « Conserver les sauts de paragraphe » activé, les éléments de bloc comme p, div et les titres ajoutent des lignes vides pour préserver la structure visuelle. Désactivé, tous les espaces se réduisent à un seul. La conversion utilise DOMParser dans votre navigateur sans envoyer de données à un serveur.
Comment utiliser
- Collez votre HTML dans la zone d'entrée ou cliquez sur Exemple pour charger un modèle.
- Activez ou désactivez « Conserver les sauts de paragraphe » selon vos besoins.
- Cliquez sur Convertir pour extraire le texte brut.
- Cliquez sur Copier pour copier le résultat dans le presse-papiers.
Cas d'utilisation
Extrayez du texte de modèles d'e-mail HTML, construisez des index de recherche, nettoyez le HTML de scraping web pour le NLP ou collez du contenu HTML dans des documents texte brut.
Questions fréquentes
- Les entités HTML sont-elles décodées ? — Oui. &amp; devient &, &lt; devient <, &nbsp; devient un espace, et toutes les entités HTML standard sont résolues.
- Les balises script et style sont-elles supprimées ? — Oui. Le contenu dans les balises script et style est complètement supprimé du résultat.
- Que fait « Conserver les sauts de paragraphe » ? — Activé, les éléments de bloc comme p, div et les titres ajoutent des lignes vides pour préserver la structure. Désactivé, tous les espaces se réduisent à un seul.
- Mon HTML est-il envoyé à un serveur ? — Non. Le traitement se fait entièrement dans votre navigateur. Votre contenu HTML ne quitte jamais votre appareil.