Aller au contenu

Chercheur de point de code (recherche Unicode)

Saisissez des points de code dans n’importe quelle notation courante, ou une plage, et obtenez les caractères avec leurs formes décimale, hex, UTF-8, UTF-16 et entité HTML.

Traité localement dans votre navigateur

Options

Auto lit les valeurs composées de chiffres seuls (128512) en décimal et celles avec des lettres A–F (1F600) en hexadécimal.

Séparez les valeurs par des espaces, virgules ou retours à la ligne. Les plages utilisent un tiret (U+0041-U+005A). 1000 caractères maximum.0 caractères · 0 lignes
Le résultat apparaîtra ici.

Qu'est-ce que Chercheur de point de code (recherche Unicode) ?

Unicode attribue à chaque caractère un numéro appelé point de code, écrit U+ suivi de 4 à 6 chiffres hexadécimaux, de U+0000 à U+10FFFF. Les documentations, le JSON, le HTML et les langages de programmation écrivent le même nombre de façons différentes : U+1F600, 0x1F600, \u{1F600}, 😀 ou le décimal 128512.

Ce chercheur accepte toutes ces notations, une ou plusieurs par ligne, ainsi que des plages comme U+0041-U+005A (jusqu’à 1000 caractères). Chaque valeur valide devient une ligne avec le caractère, le point de code, le décimal, l’hex, les octets UTF-8 et UTF-16, l’entité HTML et la catégorie générale. Les substituts (U+D800-U+DFFF), les valeurs au-delà de U+10FFFF et les jetons illisibles sont signalés au lieu d’être ignorés en silence.

Comment ça marche ?

  1. Saisissez des valeurs séparées par des espaces, virgules ou retours à la ligne, par exemple U+1F600 0x00E9 \u20AC 9731.
  2. Pour un bloc, écrivez une plage avec un tiret : U+0041-U+005A ou 65-90.
  3. Indiquez comment lire les nombres sans préfixe : auto (chiffres = décimal, lettres = hex), toujours hex ou toujours décimal.
  4. Lisez le tableau, copiez les caractères ou consultez la ligne d’état pour les valeurs refusées.

Cas d'usage courants

  • Transformer un point de code issu d’une table Unicode ou d’une spécification en caractère réel à coller.
  • Lister tous les caractères d’un bloc, comme U+2600-U+26FF pour les symboles divers, afin de choisir une icône.
  • Passer entre la notation U+, les échappements et le décimal en déboguant un problème d’encodage.
  • Retrouver l’entité HTML ou les octets UTF-8 d’un caractère qu’on ne connaît que par son numéro.

Exemples

Essayez cette saisie dans l'outil ci-dessus :

Entrée
U+1F600
0x00E9
\u20AC
9731
U+0041-U+0045
Sortie
😀é€☃ABCDE

Confidentialité

Chercheur de point de code (recherche Unicode) s'exécute entièrement dans votre navigateur. Le texte ou les fichiers que vous fournissez sont traités sur votre appareil et ne sont ni envoyés, ni journalisés, ni stockés sur nos serveurs.

Limites

Un point de code valide n’est pas toujours un caractère visible : les valeurs non attribuées, les non-caractères et les contrôles sont comptés et affichés par un symbole de remplacement. Les points de code de substitution ne sont pas des caractères à eux seuls et sont refusés.

Questions fréquentes

Comment l’outil distingue-t-il l’hexadécimal du décimal ?

Les préfixes décident d’abord : U+, 0x, \u et &#x sont hexadécimaux, &# est décimal. Pour les nombres sans préfixe, le mode auto lit les valeurs composées de chiffres comme 128512 en décimal et celles avec des lettres comme 1F600 en hexadécimal ; vous pouvez forcer l’un ou l’autre.

Pourquoi U+D83D est-il refusé ?

U+D800 à U+DFFF sont des substituts, réservés aux paires UTF-16. Écrivez la paire complète (\uD83D\uDE00) et elle est combinée en U+1F600.

Quelle est la valeur maximale ?

U+10FFFF, soit 1 114 111 en décimal. Au-delà, c’est hors limites car Unicode compte 17 plans de 65 536 points de code.

Plus d'outils dans Encodage & décodage →