Décodeur d’Entités HTML
Retrouvez les caractères derrière <, é, € et 😀.
Traité localement dans votre navigateur· Vos données restent dans votre navigateur.
Qu'est-ce que Décodeur d’Entités HTML ?
Les entités HTML sont des échappements de texte : une référence nommée comme é ou ©, une référence décimale comme é ou hexadécimale comme é. Les textes extraits du web, les flux RSS, les exports de CMS et les anciennes bases de données en contiennent souvent et doivent être décodés pour être lisibles.
Ce décodeur embarque la table complète des entités nommées de HTML 4 (environ 250 noms, dont lettres grecques, flèches, symboles mathématiques et guillemets typographiques) et les références numériques jusqu’à U+10FFFF. Il travaille uniquement sur des chaînes, sans DOM, et décode une seule fois : &lt; donne < et non <. Les noms inconnus restent en place et sont listés dans un avertissement.
Comment ça marche ?
- Collez le texte contenant des entités.
- Lisez la sortie décodée ; une note indique combien de références ont été converties.
- Consultez la liste d’avertissements pour les entités inconnues ou les nombres invalides, puis copiez le texte ou utilisez Échanger pour le ré-encoder.
Cas d'usage courants
- Nettoyer du texte copié d’un flux RSS, de la source d’un e-mail ou d’une page web extraite.
- Lire les vrais caractères derrière ' et " dans une réponse d’API.
- Vérifier ce que représente vraiment une entité comme … ou ™.
- Restaurer des noms accentués issus d’un export de base de données ancienne.
Exemples
Essayez cette saisie dans l'outil ci-dessus :
<p>Café & thé — €5 😀 © 2026</p>
<p>Café & thé — €5 😀 © 2026</p>
Confidentialité
Décodeur d’Entités HTML s'exécute entièrement dans votre navigateur. Le texte ou les fichiers que vous fournissez sont traités sur votre appareil et ne sont ni envoyés, ni journalisés, ni stockés sur nos serveurs.
Limites
Seul le jeu d’entités de HTML 4 (plus ') est intégré ; les rares noms propres à HTML5 restent non décodés, mais les références numériques fonctionnent toujours. Le résultat est du texte brut, non assaini comme du HTML.
Questions fréquentes
Pourquoi &lt; donne-t-il < et pas < ?
Il est décodé une seule fois, ce qui est correct : le texte source contenait une esperluette échappée suivie de « lt; ». N’exécutez l’outil deux fois que si le texte était doublement échappé.
Que devient une entité inconnue comme &foo; ?
Elle reste inchangée dans la sortie et apparaît dans les avertissements, pour que vous voyiez ce qui n’a pas été converti.
Comment sont traités les nombres comme – ?
Comme le font les navigateurs : les références de 128 à 159 sont associées à leurs caractères Windows-1252 (– devient un tiret demi-cadratin). Zéro, les substituts et les valeurs supérieures à U+10FFFF deviennent U+FFFD.
Outils associés
Encodeur d’Entités HTML
Échappez les caractères de balisage, ou transformez chaque caractère non ASCII en entité comme é ou é.
Encodage & décodage
Décodeur d’URL
Retrouvez du texte lisible à partir de %20, %3A ou %C3%A9, et repérez exactement où se trouve une séquence invalide.
Encodage & décodage
Annulation d’Échappement Unicode
Collez un texte plein de \u00e9, U+1F600 ou ☺ et lisez les vrais caractères.
Encodage & décodage
Convertisseur HTML en Texte
Collez du HTML et obtenez un texte brut propre, avec des sauts de ligne cohérents, des puces et l’adresse des liens en option.
Outils développeur
Supprimer les Balises HTML
Effacez toutes les balises d’un morceau de HTML et ne gardez que le texte, avec sauts de ligne et décodage des entités au choix.
Outils développeur
Déséchapper du XML
Reconvertissez les entités XML et les références numériques de caractères en caractères réels.
JSON & données
Convertisseur Décimal en Texte
Collez des points de code Unicode décimaux et obtenez les caractères qu’ils représentent, emoji compris.
Encodage & décodage