Escapar e Desescapar Unicode

Converta texto para sequências de escape Unicode como \u0041 ou decodifique sequências de escape de volta para caracteres. Útil para depuração de strings com caracteres especiais.

Funcionalidades

Formato \uXXXX
Formato \UXXXXXXXX
Formato &#xHHHH;
Formato &#DDDD;

Como Usar

1. Selecione o modo Escapar ou Desescapar.

2. Cole seu texto na entrada.

3. O resultado aparece à direita — clique em Copiar.

Sobre esta ferramenta

Escapes Unicode permitem escrever qualquer caractere usando só ASCII, o que é útil em código-fonte, JSON, arquivos de configuração e HTML quando os bytes exatos importam. Esta ferramenta converte texto para quatro formatos e de volta: \uXXXX, usado em JavaScript, JSON e Java, em que caracteres acima de U+FFFF, como emojis, viram pares substitutos; \UXXXXXXXX com oito dígitos hexadecimais para o code point completo, como em Python e C; e as referências numéricas HTML &#xHHHH; e &#DDDD;. Só os caracteres não ASCII são escapados, então letras e dígitos comuns continuam legíveis. A remoção de escapes reconhece o formato escolhido e transforma as sequências de volta em caracteres, e, se você colar texto já escapado no modo de escape, a ferramenta muda a direção automaticamente.

Perguntas Frequentes

Qual a diferença entre os escapes \u e \U?
\u é seguido de quatro dígitos hexadecimais e representa uma unidade de código UTF-16, então caracteres acima de U+FFFF precisam de dois escapes (um par substituto). \U é seguido de oito dígitos hexadecimais e representa diretamente um code point completo, como suportado em Python e C.
Por que um emoji vira dois escapes \u?
Emojis como 😀 (U+1F600) ficam fora do Plano Multilíngue Básico. No UTF-16, usado por JavaScript e Java, eles são guardados como um substituto alto e um baixo, por exemplo \ud83d\ude00.
Quando devo usar &#x; ou &#; em HTML?
Em páginas UTF-8, normalmente você pode escrever os caracteres diretamente. Referências numéricas são úteis quando um sistema remove texto não ASCII, quando você precisa de um caractere invisível como um espaço sem quebra, ou em arquivos XML com codificação restrita.
Escape Unicode é o mesmo que codificação de URL?
Não. A codificação de URL transforma os bytes UTF-8 de um caractere em sequências %XX, então é vira %C3%A9. O escape Unicode escreve o code point, então é vira \u00e9 ou é.
Por que algumas strings escapadas não voltam ao normal?
As sequências precisam corresponder exatamente ao formato selecionado. Um substituto isolado, dígitos faltando ou formatos misturados, como \u00e9 com é no mesmo texto, fazem essas partes ficarem como estão.

Ferramentas Relacionadas