🌐 FR

🧽 Convertisseur HTML en texte

Collez le code source HTML et obtenez un texte brut propre et lisible avec toutes les balises supprimées. Les éléments de bloc comme p, div et li deviennent des sauts de ligne, et les liens peuvent conserver leur URL à côté du texte du lien.

Caractères HTML
0
Caractères du texte extrait
0

Sécurité : le HTML n’est analysé qu’avec le DOMParser intégré au navigateur, qui n’est jamais attaché à la page en cours, donc les scripts ne s’exécutent jamais. Le résultat extrait est toujours affiché en texte brut.

GUIDE

En savoir plus

01

1. Pourquoi convertir le HTML en texte brut

Copier le HTML directement depuis une page web ou le code source d’une newsletter entraîne les balises, les attributs de style et même du code de script intégré. Quand vous n’avez besoin que du contenu lisible — pour une application de notes, un index de recherche ou une ébauche en texte brut — vous voulez seulement le texte. Cet outil supprime chaque balise et ne conserve que ce qu’un humain lirait vraiment.

02

2. Pourquoi l’analyse reste sûre

Cet outil analyse la chaîne HTML avec le DOMParser intégré au navigateur. Le document produit par DOMParser est « inerte » — il n’est jamais attaché au DOM de la page active, donc aucun <script> qu’il contient ne s’exécute et aucune image ou ressource externe n’est chargée. De plus, les contenus <script> et <style> sont entièrement exclus de l’extraction, et le résultat est toujours écrit dans la valeur d’une textarea, jamais réaffiché en HTML.

03

3. Conserver les liens et les sauts de ligne de niveau bloc

Activez « Conserver les URL des liens » pour ajouter le href réel entre parenthèses après le texte visible de chaque lien, afin de savoir exactement où chaque lien pointait. Les éléments de niveau bloc — p, div, li, tr, h1 à h6 — deviennent automatiquement des sauts de ligne, afin que le texte converti conserve à peu près la structure originale des paragraphes et des listes.

Questions fréquentes

Un script dans le HTML collé peut-il s’exécuter ?
Non. Les documents produits par DOMParser sont inertes et ne sont jamais attachés à la page active, donc les scripts qu’ils contiennent ne s’exécutent jamais. Le texte extrait est également toujours écrit comme valeur de textarea, jamais réinterprété en HTML.
Comment les cellules du tableau sont-elles séparées ?
Chaque ligne <tr> obtient un saut de ligne, mais les cellules (<td>) d’une ligne sont regroupées sans séparateur supplémentaire. Pour préserver exactement la mise en page du tableau, consultez directement la source d’origine.
Mon HTML est-il envoyé vers un serveur ?
Non. Tout fonctionne dans votre navigateur — cet outil n’appelle jamais d’API backend.