Échappement & Désechappement Unicode

Convertissez du texte en séquences d'échappement Unicode comme \u0041, ou décodez des séquences d'échappement en caractères lisibles. Utile pour le débogage et le traitement de chaînes internationales.

Fonctionnalités

Format \uXXXX
Format \UXXXXXXXX
Format &#xHHHH;
Format &#DDDD;

Comment Utiliser

1. Choisissez le mode Échapper ou Désechapper.

2. Collez votre texte dans la zone de saisie.

3. Le résultat apparaît à droite — cliquez sur Copier.

À propos de cet outil

Les échappements Unicode permettent d'écrire n'importe quel caractère avec de l'ASCII seulement, ce qui est utile dans le code source, le JSON, les fichiers de configuration et le HTML quand les octets exacts comptent. Cet outil convertit le texte vers quatre formats et inversement : \uXXXX comme en JavaScript, JSON et Java, où les caractères au-delà de U+FFFF, comme les emojis, deviennent des paires de substitution ; \UXXXXXXXX avec huit chiffres hexadécimaux pour le point de code complet, comme en Python et en C ; et les références numériques HTML &#xHHHH; et &#DDDD;. Seuls les caractères non ASCII sont échappés : les lettres et chiffres ordinaires restent lisibles. Le déséchappement reconnaît le format choisi et retransforme les séquences en caractères ; si vous collez un texte déjà échappé en mode échappement, l'outil change de sens automatiquement.

Questions Fréquentes

Quelle différence entre les échappements \u et \U ?
\u est suivi de quatre chiffres hexadécimaux et représente une unité de code UTF-16 : les caractères au-delà de U+FFFF nécessitent donc deux échappements (une paire de substitution). \U est suivi de huit chiffres hexadécimaux et représente directement un point de code complet, comme le permettent Python et C.
Pourquoi un emoji devient-il deux échappements \u ?
Les emojis comme 😀 (U+1F600) se situent hors du plan multilingue de base. En UTF-16, utilisé par JavaScript et Java, ils sont stockés sous forme d'un demi-codet haut et d'un demi-codet bas, par exemple \ud83d\ude00.
Quand utiliser &#x; ou &#; en HTML ?
Sur une page en UTF-8, vous pouvez généralement écrire les caractères directement. Les références numériques sont utiles quand un système supprime le texte non ASCII, quand vous avez besoin d'un caractère invisible comme une espace insécable, ou dans des fichiers XML à l'encodage restreint.
L'échappement Unicode est-il la même chose que l'encodage d'URL ?
Non. L'encodage d'URL transforme les octets UTF-8 d'un caractère en séquences %XX : é devient %C3%A9. L'échappement Unicode écrit le point de code : é devient \u00e9 ou é.
Pourquoi certaines chaînes échappées ne se reconvertissent-elles pas ?
Les séquences doivent correspondre exactement au format sélectionné. Un demi-codet isolé, des chiffres manquants ou un mélange de formats comme \u00e9 avec é dans le même texte laissent ces parties inchangées.

Outils Associés