Convertir du HTML en texte brut
Extrayez le texte brut d’un code HTML : toutes les balises sont retirées, la structure en paragraphes est conservée.

Ce que fait la conversion
Les balises sont supprimées, mais la structure du document est respectée : les <br>, les fins de paragraphe, de titre, de division et d’élément de liste deviennent de vrais retours à la ligne. Les entités HTML (é, , &) sont décodées en caractères normaux.
Les espaces multiples et les lignes vides en excès sont ensuite compressés, pour un résultat directement lisible.
Les usages
- Compter les mots réels d’une page, hors balisage — enchaînez avec le compteur de mots.
- Récupérer un contenu depuis un export CMS ou une newsletter HTML.
- Créer la version texte d’un e-mail HTML, indispensable pour la délivrabilité.
- Nettoyer un copier-coller avant de le remettre en forme.
Attention aux scripts et aux styles
Le contenu des balises <script> et <style> n’est pas du texte visible mais reste techniquement du contenu textuel. Si votre HTML en contient, vérifiez le résultat : du code CSS ou JavaScript peut apparaître. Le plus simple est de ne coller que la partie du HTML qui vous intéresse.
Questions fréquentes
Les liens sont-ils conservés ?
Le texte du lien est conservé, mais pas l’adresse. Pour récupérer les URL, utilisez plutôt l’extracteur d’URL sur le code HTML d’origine.
Le HTML est-il exécuté ?
Non. Le code est analysé dans un élément détaché du document : aucune image n’est chargée, aucun script n’est exécuté. Rien n’est envoyé à un serveur.