Convertir du texte ou des références intégrées

Collez le contenu directement. La conversion se fait dans le navigateur, sans transmettre la saisie dans des requêtes réseau. Il n'y a ni import de fichiers ni traitement par lots.

  1. Saisissez le texte à encoder ou le contenu avec références à décoder, puis lancez l'opération correspondante.
  2. Vérifiez et copiez le résultat textuel. Modifier la saisie ou rencontrer une erreur de conversion efface l'ancienne sortie et désactive la copie.
  3. Pour une autre opération, collez vous-même le résultat dans la saisie. Effacer vide les deux champs.

Sortie décimale et décodage sélectif

Des références fondées sur les points de code

A你😀 devient A你😀. L'emoji correspond à un point de code entier, sans découpage en références de demi-codets UTF-16. Les lettres et espaces sont aussi encodées : é donne é, une espace   et LF 
. Aucune référence nommée n'est produite.

Trois formes reconnues dans la saisie

Le décodage reconnaît le décimal comme A, l'hexadécimal comme A ou A, et \u avec un u minuscule suivi de quatre chiffres hexadécimaux, comme \u0041. Les références numériques exigent un point-virgule. Les chiffres hexadécimaux acceptent les deux casses ; le texte environnant est conservé.

😀, 😀 et la paire \uD83D\uDE00 donnent chacun 😀. Il s'agit de convertir des séquences, pas d'analyser une chaîne JS/JSON complète ni d'exécuter du HTML.

Des contrôles différents selon le format

he 1.2.0 applique les contrôles HTML stricts à l'encodage et au décodage des références numériques. Les références comme �, €, � et � sont rejetées. L'encodage refuse NUL, les contrôles C1 comme U+0080, U+FFFF et les demi-codets isolés.

Ces contrôles HTML ne s'appliquent pas à la branche \uXXXX : \u0000 et \uFFFF sont décodés en leurs unités de code. Le contrôle final de la sortie rejette uniquement les demi-codets isolés.

L'ancienne forme �� est rejetée au lieu d'être assemblée. Utilisez 😀 pour cet emoji.

Questions sur les références numériques

Pourquoi certaines écritures incorrectes ne provoquent-elles pas d'erreur ?

Seules les trois formes reconnues sont converties. \uZZZZ, \u{41}, \U0041, &#xZZ; et &#65 sans point-virgule restent du texte, tout comme &, les nombres isolés tels que 65 66 et \n. L'outil ne valide pas toute syntaxe possible et ne décode pas les octets UTF-8.

Le décodage traite-t-il plusieurs niveaux à la fois ?

Non. A et \u0026#65; deviennent tous deux le texte littéral A, pas A. Le texte obtenu par remplacement n'est pas analysé une seconde fois.

Les espaces ou la saisie vide sont-ils supprimés ?

Aucun caractère blanc n'est retiré et Unicode n'est pas normalisé ; une saisie vide donne une sortie vide. Le textarea normalise les fins de ligne réelles CRLF/CR en LF. Le noyau peut encoder CR en 
, mais le décodage numérique strict rejette 
. Un aller-retour n'est donc pas garanti pour toute entrée.

Outils récents :