Unicode 이스케이프 및 언이스케이프

텍스트를 \u0041과 같은 Unicode 이스케이프 시퀀스로 변환하거나, 이스케이프 시퀀스를 원래 문자로 디코딩합니다.

기능

\uXXXX 형식
\UXXXXXXXX 형식
&#xHHHH; 형식
&#DDDD; 형식

사용 방법

1. 이스케이프 또는 언이스케이프 모드를 선택하세요.

2. 입력란에 텍스트를 붙여넣으세요.

3. 오른쪽에 결과가 표시됩니다. 복사 버튼을 클릭하세요.

이 도구에 대하여

유니코드 이스케이프를 쓰면 어떤 문자든 ASCII만으로 적을 수 있어, 정확한 바이트가 중요한 소스 코드, JSON, 설정 파일, HTML에서 유용합니다. 이 도구는 텍스트를 네 가지 형식으로 바꾸고 되돌립니다. JavaScript, JSON, Java에서 쓰는 \uXXXX는 이모지처럼 U+FFFF를 넘는 문자를 서로게이트 쌍으로 나타내고, Python과 C에서 쓰는 \UXXXXXXXX는 16진수 8자리로 전체 코드 포인트를 적으며, HTML 숫자 참조 &#xHHHH;와 &#DDDD;도 지원합니다. 비ASCII 문자만 이스케이프하므로 일반 영문자와 숫자는 읽을 수 있게 남습니다. 되돌리기는 선택한 형식을 인식해 시퀀스를 문자로 바꾸며, 이스케이프 모드에서 이미 이스케이프된 텍스트를 붙여넣으면 방향을 자동으로 바꿉니다.

자주 묻는 질문

\u와 \U 이스케이프는 어떻게 다른가요?
\u 뒤에는 16진수 4자리가 오며 UTF-16 코드 단위 하나를 나타내므로, U+FFFF를 넘는 문자는 이스케이프 두 개(서로게이트 쌍)가 필요합니다. \U 뒤에는 16진수 8자리가 오며 Python과 C에서 지원하듯 전체 코드 포인트를 직접 나타냅니다.
이모지가 \u 이스케이프 두 개가 되는 이유는 무엇인가요?
😀(U+1F600) 같은 이모지는 기본 다국어 평면 밖에 있습니다. JavaScript와 Java가 쓰는 UTF-16에서는 상위 서로게이트와 하위 서로게이트 두 개로 저장되며, 예를 들면 \ud83d\ude00입니다.
HTML에서 &#x;나 &#;는 언제 쓰나요?
UTF-8 페이지에서는 보통 문자를 그대로 쓸 수 있습니다. 숫자 참조는 시스템이 비ASCII 텍스트를 지워 버릴 때, 줄바꿈 없는 공백처럼 보이지 않는 문자가 필요할 때, 인코딩이 제한된 XML 파일에서 유용합니다.
유니코드 이스케이프는 URL 인코딩과 같은가요?
아니요. URL 인코딩은 문자의 UTF-8 바이트를 %XX 시퀀스로 바꾸므로 é는 %C3%A9가 됩니다. 유니코드 이스케이프는 코드 포인트를 적으므로 é는 \u00e9나 é가 됩니다.
일부 이스케이프 문자열이 되돌려지지 않는 이유는 무엇인가요?
시퀀스가 선택한 형식과 정확히 일치해야 합니다. 짝이 없는 서로게이트, 모자란 자릿수, 또는 같은 텍스트 안에서 \u00e9와 é처럼 형식을 섞어 쓰면 그 부분은 바뀌지 않고 남습니다.

관련 도구