Passer des caractères aux références

Collez du texte, des références décimales ou un mélange des deux. Le calcul s'effectue dans le navigateur, sans transmettre la saisie dans des requêtes de conversion. La sortie reste du texte brut, même lorsqu'elle ressemble à du HTML.

  1. Encodez A你😀 pour obtenir A你😀. Les lettres ordinaires, les espaces et la ponctuation sont également convertis.
  2. Pour décoder, utilisez &# suivi de chiffres décimaux et d'un point-virgule. Par exemple, texte A devient texte A sans supprimer le mot qui précède.
  3. Copiez le résultat. Pour le convertir à nouveau, recollez-le dans l'entrée. Modifier la saisie ou rencontrer une erreur efface l'ancienne sortie ; Effacer vide l'entrée et le résultat.

Ce que lit le décodeur décimal

Un nombre pour le point de code complet

L'emoji 😀 correspond à 😀. La paire de références de substituts UTF-16 �� de l'ancienne version est rejetée. Il ne s'agit pas de convertir les octets d'un encodage UTF-8.

Seules les références décimales terminées par un point-virgule sont reconnues. A, &, \u0041, les nombres isolés et &#65 sans terminaison restent littéraux. Les outils ASCII et Unicode proposent d'autres formats, sans que cette page les interprète.

Préserver le texte sans décodage récursif

Une seule passe est appliquée : A devient le texte A, pas A. Les parties de la saisie qui ne correspondent pas à une référence restent en place. Ce traitement ne valide pas un document HTML complet.

Les références reconnues sont soumises au mode strict de he 1.2.0. �, €, les valeurs de substituts et � sont notamment refusés. L'encodage rejette aussi certains caractères interdits en HTML et les substituts isolés. Une erreur efface l'ancien résultat et empêche de copier une sortie partielle.

À propos des références décimales

Les espaces et retours à la ligne sont-ils toujours conservés ?

Les espaces ne sont pas rognés et aucune normalisation Unicode n'est appliquée. Un espace donne   et LF donne 
. Le champ de saisie transforme toutefois les fins de ligne CR et CRLF réelles en LF. Le noyau peut encoder CR sous la forme 
, mais le décodage strict refuse 
. Un aller-retour exact n'est donc pas garanti pour toute entrée.

Pourquoi une saisie reste-t-elle identique après décodage ?

Sans référence décimale reconnue, elle est normalement rendue telle quelle ; une entrée vide donne une sortie vide. Les véritables caractères substituts isolés dans le résultat restent toutefois interdits. La suite littérale \uD800 n'est pas un tel caractère et reste inchangée. Une référence reconnue peut aussi échouer à la validation. L'ancien nom Native / Unicode n'indique pas une prise en charge de tous les échappements Unicode.

Outils récents :