Aller au contenu

Décodeur d’Entités HTML

Retrouvez les caractères derrière <, é, € et 😀.

Traité localement dans votre navigateur

0 caractères · 0 lignes
Le résultat apparaîtra ici.

Qu'est-ce que Décodeur d’Entités HTML ?

Les entités HTML sont des échappements de texte : une référence nommée comme é ou ©, une référence décimale comme é ou hexadécimale comme é. Les textes extraits du web, les flux RSS, les exports de CMS et les anciennes bases de données en contiennent souvent et doivent être décodés pour être lisibles.

Ce décodeur embarque la table complète des entités nommées de HTML 4 (environ 250 noms, dont lettres grecques, flèches, symboles mathématiques et guillemets typographiques) et les références numériques jusqu’à U+10FFFF. Il travaille uniquement sur des chaînes, sans DOM, et décode une seule fois : &amp;lt; donne &lt; et non <. Les noms inconnus restent en place et sont listés dans un avertissement.

Comment ça marche ?

  1. Collez le texte contenant des entités.
  2. Lisez la sortie décodée ; une note indique combien de références ont été converties.
  3. Consultez la liste d’avertissements pour les entités inconnues ou les nombres invalides, puis copiez le texte ou utilisez Échanger pour le ré-encoder.

Cas d'usage courants

  • Nettoyer du texte copié d’un flux RSS, de la source d’un e-mail ou d’une page web extraite.
  • Lire les vrais caractères derrière &#x27; et &quot; dans une réponse d’API.
  • Vérifier ce que représente vraiment une entité comme &hellip; ou &trade;.
  • Restaurer des noms accentués issus d’un export de base de données ancienne.

Exemples

Essayez cette saisie dans l'outil ci-dessus :

Entrée
&lt;p&gt;Caf&eacute; &amp; th&eacute; &mdash; &#8364;5 &#x1F600; &copy; 2026&lt;/p&gt;
Sortie
<p>Café & thé — €5 😀 © 2026</p>

Confidentialité

Décodeur d’Entités HTML s'exécute entièrement dans votre navigateur. Le texte ou les fichiers que vous fournissez sont traités sur votre appareil et ne sont ni envoyés, ni journalisés, ni stockés sur nos serveurs.

Limites

Seul le jeu d’entités de HTML 4 (plus &apos;) est intégré ; les rares noms propres à HTML5 restent non décodés, mais les références numériques fonctionnent toujours. Le résultat est du texte brut, non assaini comme du HTML.

Questions fréquentes

Pourquoi &amp;lt; donne-t-il &lt; et pas < ?

Il est décodé une seule fois, ce qui est correct : le texte source contenait une esperluette échappée suivie de « lt; ». N’exécutez l’outil deux fois que si le texte était doublement échappé.

Que devient une entité inconnue comme &foo; ?

Elle reste inchangée dans la sortie et apparaît dans les avertissements, pour que vous voyiez ce qui n’a pas été converti.

Comment sont traités les nombres comme &#150; ?

Comme le font les navigateurs : les références de 128 à 159 sont associées à leurs caractères Windows-1252 (&#150; devient un tiret demi-cadratin). Zéro, les substituts et les valeurs supérieures à U+10FFFF deviennent U+FFFD.

Plus d'outils dans Encodage & décodage →