문자 ↔ 코드포인트 변환기
변환 방향을 고르고 문자나 U+ 값을 입력하세요. 결과와 문자별 코드포인트가 바로 나타납니다.
입력
원문 그대로공백·줄바꿈도 각각 변환합니다. 입력한 문자 조합은 바꾸지 않습니다.
결과
0 코드포인트코드포인트 수는 화면에 보이는 글자 수와 다를 수 있습니다.
입력하면 결과가 바로 나타납니다.
문자별 보기
입력 순서대로입력하면 문자·16진수·10진수를 나란히 확인할 수 있습니다.
바로 쓸 수 있게.
- 바로 보이는 화면입력 위치와 결과 위치를 또렷하게 둡니다.
- 결과 먼저핵심 결과를 앞에 두고, 과정은 필요할 때만 보여줍니다.
- 요구 줄이기가입이나 불필요한 정보 입력 없이 바로 쓰게 합니다.
문자와 코드포인트를 읽는 방법
유니코드 변환기는 문자를 U+AC00 같은 코드포인트로 바꾸고, 코드포인트를 다시 문자로 돌려줍니다. “가”는 U+AC00, “A”는 U+0041, “😀”는 U+1F600입니다. 한글이나 이모지의 정확한 문자값을 확인하거나 코드 목록에서 원문을 복원할 때 쓸 수 있습니다.
입력한 문자열을 코드포인트 순서대로 읽으며 공백과 줄바꿈도 포함합니다. 눈에 한 글자로 보여도 여러 값으로 이뤄진 문자는 세부 목록에서 각각 확인할 수 있습니다. 변환은 브라우저 안에서 처리하며, 입력 내용을 변환 서버에 보내거나 자동 저장하지 않습니다.
코드포인트와 U+는 무엇인가요?
코드포인트는 유니코드 코드 공간에서 각 위치를 나타내는 숫자입니다. U+ 뒤의 값은 16진수이며, 이 도구는 영문을 대문자로 쓰고 최소 네 자리로 출력합니다. 같은 값을 10진수로도 표시하므로 문서나 프로그램에서 쓰는 숫자 표기를 비교할 수 있습니다.
- 가: U+AC00 → 10진수 44032
- A: U+0041 → 10진수 65
- 😀: U+1F600 → 10진수 128512
문자를 코드포인트로 어떻게 바꾸나요?
“문자 → U+”를 선택한 뒤 문자를 입력하거나 붙여 넣으면 됩니다. 결과는 각 코드포인트를 공백 하나로 구분한 목록입니다. 원문의 공백은 사라지는 대신 U+0020으로 표시되므로, 결과의 구분용 공백과 원문에 있던 공백을 구별할 수 있습니다.
- 가A → U+AC00 U+0041
- 가 A → U+AC00 U+0020 U+0041
- 문자별 보기에서 원문의 순서와 10진수 값도 확인하세요.
U+ 값을 다시 문자로 돌리려면?
“U+ → 문자”를 고른 뒤 U+AC00처럼 값을 입력하세요. 여러 값은 공백·쉼표·줄바꿈으로 구분합니다. 접두사와 16진수의 대소문자는 구분하지 않으며, U+41 같은 짧은 입력도 A로 변환합니다. 문자별 보기의 코드포인트는 U+0041처럼 최소 네 자리로 표시합니다.
- U+AC00, U+0041 → 가A
- u+1f600 → 😀
- 실제 공백을 넣으려면 U+0020, 실제 줄바꿈은 U+000A를 목록에 넣으세요.
가와 가는 왜 값이 다른가요?
완성형 “가”는 U+AC00 하나지만, 첫소리 ᄀ(U+1100)과 가운뎃소리 ᅡ(U+1161)를 이어 쓴 “가”는 코드포인트 두 개입니다. 화면에서 같은 한글 음절처럼 보여도 저장된 구성은 다를 수 있습니다. 이 도구는 그 차이를 드러내기 위해 정규화를 적용하지 않습니다.
- 가 → U+AC00: 코드포인트 1개
- 가 → U+1100 U+1161: 코드포인트 2개
- 조합을 자동으로 합치거나 분해하지 않으므로 원문의 구성을 비교할 수 있습니다.
이모지 하나가 여러 코드포인트인가요?
그럴 수 있습니다. 😀는 코드포인트 하나지만 👩💻는 여성 U+1F469, 결합을 잇는 ZWJ U+200D, 노트북 U+1F4BB로 이뤄집니다. 사용자가 한 글자로 느끼는 단위인 그래핌 클러스터와 코드포인트 수는 일치하지 않을 수 있습니다.
- 👩💻 → U+1F469 U+200D U+1F4BB: 3개
- 피부색·국기·이모지 표현 선택자가 붙으면 구성 값이 늘어날 수 있습니다.
- 숫자 옆 “코드포인트”는 화면에 보이는 글자 수나 이모지 개수를 뜻하지 않습니다.
보이지 않는 문자도 확인할 수 있나요?
공백·탭·줄바꿈·폭 없는 연결 문자도 코드포인트가 있습니다. 세부 목록은 알려진 숨은 문자에 이름을 붙여 보여 줍니다. 결합 문자는 점선 원과 함께 표시해 위치를 알아보기 쉽게 하며, 점선 원은 복사 결과에 들어가지 않습니다.
- 일반 공백 U+0020, 탭 U+0009, 줄바꿈 LF U+000A
- 폭 없는 공백 U+200B, 이모지 연결자 ZWJ U+200D
- 복원한 결과가 비어 보이면 문자별 목록에서 공백·제어 문자인지 확인하세요.
U+AC00과 \uAC00은 같은 형식인가요?
둘 다 “가”를 가리킬 수 있지만 쓰는 문법이 다릅니다. U+AC00은 코드포인트 표기이고, 역슬래시가 붙은 \uAC00은 JavaScript·JSON 등에서 사용하는 이스케이프 표기입니다. 이 도구의 역변환은 U+ 형식만 받으므로 코드 문자열을 그대로 붙여 넣으면 형식 오류가 납니다.
- U+AC00: 이 도구에서 문자로 변환할 수 있습니다.
- \uAC00, 가, 0xAC00: 이 도구의 입력 문법이 아닙니다.
- 10진수 열의 44032를 역변환하려면 U+AC00 형태로 입력하세요.
UTF-8 바이트나 UTF-16 길이와 무엇이 다른가요?
코드포인트는 문자에 대응하는 값이고, UTF-8과 UTF-16은 그 값을 저장하는 인코딩 방식입니다. 😀의 코드포인트는 U+1F600 하나지만 UTF-8에서는 네 바이트, UTF-16에서는 두 코드 유닛이 필요합니다. 코드포인트 수만으로 파일 크기나 메모리 길이를 판단할 수는 없습니다.
- 가: 코드포인트 1개, UTF-8 3바이트, UTF-16 1코드 유닛
- 😀: 코드포인트 1개, UTF-8 4바이트, UTF-16 2코드 유닛
- 이 도구의 U+ 결과는 UTF-8 바이트 덤프나 UTF-16 이스케이프 결과가 아닙니다.
어떤 코드값에서 오류가 나나요?
유니코드 코드 공간의 끝은 U+10FFFF입니다. 그보다 큰 값과, 독립된 문자를 뜻하지 않는 서로게이트 영역 U+D800~U+DFFF는 변환할 수 없습니다. 목록 중 하나라도 틀리면 오류 위치를 알려 주고 전체 결과를 비워 일부만 복사하는 일을 막습니다.
- U+110000: 최대 범위 초과
- U+D800: 서로게이트 값으로 변환 불가
- U+ZZZZ: 16진수 형식 오류. 입력의 짝 없는 UTF-16 서로게이트도 거부합니다.
값은 정상인데 왜 글자가 네모로 보이나요?
허용 범위의 값이라고 모두 현재 정의된 문자이거나 화면에 그릴 수 있는 문자는 아닙니다. 미할당 위치·비문자·제어 문자도 있고, 글꼴이 특정 문자를 지원하지 않을 수 있습니다. 이 도구는 서로게이트를 뺀 스칼라 값의 변환을 제공하며, 글꼴 지원이나 사용 중인 시스템의 입력 허용 여부는 판정하지 않습니다.
- 네모 모양은 지원 글꼴이 없다는 표시일 수 있습니다.
- 문자별 목록은 처음 80개까지 표시하지만 결과와 복사는 전체를 포함합니다.
- 브라우저의 텍스트 입력칸에서는 CRLF가 LF로 바뀔 수 있어 원본 파일의 줄 끝 바이트를 그대로 검사하는 용도로는 적합하지 않습니다.
유니코드 변환 자주 묻는 질문
한글 가의 유니코드는 무엇인가요?
완성형 한글 가의 코드포인트는 U+AC00이며 10진수로 44032입니다. 문자 → U+에 가를 입력하면 확인할 수 있습니다.
U+AC00을 한글로 바꾸려면 어떻게 하나요?
U+ → 문자 방향에서 U+AC00을 입력하면 가가 나옵니다. U+AC00 U+0041을 입력하면 가A가 됩니다.
이모지도 문자와 코드포인트를 왕복 변환할 수 있나요?
네. 😀는 U+1F600으로 왕복 변환합니다. 👩💻처럼 여러 값이 이어진 이모지는 U+1F469 U+200D U+1F4BB를 모두 입력해야 같은 구성을 복원할 수 있습니다.
공백과 줄바꿈은 어떤 값으로 입력하나요?
일반 공백은 U+0020, 탭은 U+0009, 줄바꿈 LF는 U+000A입니다. U+0041 U+000A U+0042를 변환하면 A와 B가 서로 다른 줄에 놓입니다.
U+ 뒤에 소문자나 짧은 숫자를 써도 되나요?
네. u+ac00과 U+AC00은 모두 “가”로 변환합니다. U+41도 A로 인식하며, 문자 → U+ 결과는 최소 네 자리인 U+0041로 표시합니다.
U+D800을 입력했더니 왜 오류가 나나요?
U+D800은 UTF-16의 서로게이트 영역에 속합니다. 이 영역의 값은 단독 스칼라 값이 아니므로 문자로 복원하지 않습니다. 😀를 원하면 서로게이트 쌍 대신 U+1F600을 입력하세요.
똑같이 보이는 한글의 코드포인트가 다른 이유는 무엇인가요?
완성형 가는 U+AC00 하나이고, 자모로 조합한 가는 U+1100과 U+1161 두 개입니다. 이 도구는 입력을 정규화하지 않아 원래 구성의 차이가 그대로 나타납니다.
입력한 문자는 어디에 저장되나요?
이 도구는 입력을 자동 저장하거나 변환을 위해 서버로 보내지 않습니다. 현재 브라우저에서 변환하며 새로고침하면 입력이 사라집니다. 필요한 결과는 먼저 복사해 두세요.
유니코드 정의를 확인한 자료
코드포인트 표기와 스칼라 값 범위는 Unicode 표준 정의를 따릅니다. 그래핌 클러스터 문서는 화면에서 한 글자로 보이는 단위와 코드포인트의 차이를 설명합니다. 개별 문자의 글꼴 지원 여부는 변환 범위와 별개입니다.
함께 쓰면 좋은 텍스트 도구
- 글자수 세기 · 글과 문장의 길이를 확인할 때
- 전각 ↔ 반각 변환기 · 닮은 전각·반각 문자를 바꿀 때
- 텍스트 정리기 · 공백과 줄바꿈을 정리할 때