필요한 툴을, 바로 쓸 수 있게

문자 ↔ 코드포인트 변환기

변환 방향을 고르고 문자나 U+ 값을 입력하세요. 결과와 문자별 코드포인트가 바로 나타납니다.

입력

원문 그대로

공백·줄바꿈도 각각 변환합니다. 입력한 문자 조합은 바꾸지 않습니다.

결과

0 코드포인트

코드포인트 수는 화면에 보이는 글자 수와 다를 수 있습니다.

브라우저에서 변환

입력하면 결과가 바로 나타납니다.

문자별 보기

입력 순서대로
순서문자코드포인트 · 16진수10진수

입력하면 문자·16진수·10진수를 나란히 확인할 수 있습니다.

ROBERIN 기준필요한 툴을,
바로 쓸 수 있게.
  • 바로 보이는 화면입력 위치와 결과 위치를 또렷하게 둡니다.
  • 결과 먼저핵심 결과를 앞에 두고, 과정은 필요할 때만 보여줍니다.
  • 요구 줄이기가입이나 불필요한 정보 입력 없이 바로 쓰게 합니다.
Roberin

문자와 코드포인트를 읽는 방법

유니코드 변환기는 문자를 U+AC00 같은 코드포인트로 바꾸고, 코드포인트를 다시 문자로 돌려줍니다. “가”는 U+AC00, “A”는 U+0041, “😀”는 U+1F600입니다. 한글이나 이모지의 정확한 문자값을 확인하거나 코드 목록에서 원문을 복원할 때 쓸 수 있습니다.

입력한 문자열을 코드포인트 순서대로 읽으며 공백과 줄바꿈도 포함합니다. 눈에 한 글자로 보여도 여러 값으로 이뤄진 문자는 세부 목록에서 각각 확인할 수 있습니다. 변환은 브라우저 안에서 처리하며, 입력 내용을 변환 서버에 보내거나 자동 저장하지 않습니다.

코드포인트와 U+는 무엇인가요?

코드포인트는 유니코드 코드 공간에서 각 위치를 나타내는 숫자입니다. U+ 뒤의 값은 16진수이며, 이 도구는 영문을 대문자로 쓰고 최소 네 자리로 출력합니다. 같은 값을 10진수로도 표시하므로 문서나 프로그램에서 쓰는 숫자 표기를 비교할 수 있습니다.

  • 가: U+AC00 → 10진수 44032
  • A: U+0041 → 10진수 65
  • 😀: U+1F600 → 10진수 128512

문자를 코드포인트로 어떻게 바꾸나요?

“문자 → U+”를 선택한 뒤 문자를 입력하거나 붙여 넣으면 됩니다. 결과는 각 코드포인트를 공백 하나로 구분한 목록입니다. 원문의 공백은 사라지는 대신 U+0020으로 표시되므로, 결과의 구분용 공백과 원문에 있던 공백을 구별할 수 있습니다.

  • 가A → U+AC00 U+0041
  • 가 A → U+AC00 U+0020 U+0041
  • 문자별 보기에서 원문의 순서와 10진수 값도 확인하세요.

U+ 값을 다시 문자로 돌리려면?

“U+ → 문자”를 고른 뒤 U+AC00처럼 값을 입력하세요. 여러 값은 공백·쉼표·줄바꿈으로 구분합니다. 접두사와 16진수의 대소문자는 구분하지 않으며, U+41 같은 짧은 입력도 A로 변환합니다. 문자별 보기의 코드포인트는 U+0041처럼 최소 네 자리로 표시합니다.

  • U+AC00, U+0041 → 가A
  • u+1f600 → 😀
  • 실제 공백을 넣으려면 U+0020, 실제 줄바꿈은 U+000A를 목록에 넣으세요.

가와 가는 왜 값이 다른가요?

완성형 “가”는 U+AC00 하나지만, 첫소리 ᄀ(U+1100)과 가운뎃소리 ᅡ(U+1161)를 이어 쓴 “가”는 코드포인트 두 개입니다. 화면에서 같은 한글 음절처럼 보여도 저장된 구성은 다를 수 있습니다. 이 도구는 그 차이를 드러내기 위해 정규화를 적용하지 않습니다.

  • 가 → U+AC00: 코드포인트 1개
  • 가 → U+1100 U+1161: 코드포인트 2개
  • 조합을 자동으로 합치거나 분해하지 않으므로 원문의 구성을 비교할 수 있습니다.

이모지 하나가 여러 코드포인트인가요?

그럴 수 있습니다. 😀는 코드포인트 하나지만 👩‍💻는 여성 U+1F469, 결합을 잇는 ZWJ U+200D, 노트북 U+1F4BB로 이뤄집니다. 사용자가 한 글자로 느끼는 단위인 그래핌 클러스터와 코드포인트 수는 일치하지 않을 수 있습니다.

  • 👩‍💻 → U+1F469 U+200D U+1F4BB: 3개
  • 피부색·국기·이모지 표현 선택자가 붙으면 구성 값이 늘어날 수 있습니다.
  • 숫자 옆 “코드포인트”는 화면에 보이는 글자 수나 이모지 개수를 뜻하지 않습니다.

보이지 않는 문자도 확인할 수 있나요?

공백·탭·줄바꿈·폭 없는 연결 문자도 코드포인트가 있습니다. 세부 목록은 알려진 숨은 문자에 이름을 붙여 보여 줍니다. 결합 문자는 점선 원과 함께 표시해 위치를 알아보기 쉽게 하며, 점선 원은 복사 결과에 들어가지 않습니다.

  • 일반 공백 U+0020, 탭 U+0009, 줄바꿈 LF U+000A
  • 폭 없는 공백 U+200B, 이모지 연결자 ZWJ U+200D
  • 복원한 결과가 비어 보이면 문자별 목록에서 공백·제어 문자인지 확인하세요.

U+AC00과 \uAC00은 같은 형식인가요?

둘 다 “가”를 가리킬 수 있지만 쓰는 문법이 다릅니다. U+AC00은 코드포인트 표기이고, 역슬래시가 붙은 \uAC00은 JavaScript·JSON 등에서 사용하는 이스케이프 표기입니다. 이 도구의 역변환은 U+ 형식만 받으므로 코드 문자열을 그대로 붙여 넣으면 형식 오류가 납니다.

  • U+AC00: 이 도구에서 문자로 변환할 수 있습니다.
  • \uAC00, 가, 0xAC00: 이 도구의 입력 문법이 아닙니다.
  • 10진수 열의 44032를 역변환하려면 U+AC00 형태로 입력하세요.

UTF-8 바이트나 UTF-16 길이와 무엇이 다른가요?

코드포인트는 문자에 대응하는 값이고, UTF-8과 UTF-16은 그 값을 저장하는 인코딩 방식입니다. 😀의 코드포인트는 U+1F600 하나지만 UTF-8에서는 네 바이트, UTF-16에서는 두 코드 유닛이 필요합니다. 코드포인트 수만으로 파일 크기나 메모리 길이를 판단할 수는 없습니다.

  • 가: 코드포인트 1개, UTF-8 3바이트, UTF-16 1코드 유닛
  • 😀: 코드포인트 1개, UTF-8 4바이트, UTF-16 2코드 유닛
  • 이 도구의 U+ 결과는 UTF-8 바이트 덤프나 UTF-16 이스케이프 결과가 아닙니다.

어떤 코드값에서 오류가 나나요?

유니코드 코드 공간의 끝은 U+10FFFF입니다. 그보다 큰 값과, 독립된 문자를 뜻하지 않는 서로게이트 영역 U+D800~U+DFFF는 변환할 수 없습니다. 목록 중 하나라도 틀리면 오류 위치를 알려 주고 전체 결과를 비워 일부만 복사하는 일을 막습니다.

  • U+110000: 최대 범위 초과
  • U+D800: 서로게이트 값으로 변환 불가
  • U+ZZZZ: 16진수 형식 오류. 입력의 짝 없는 UTF-16 서로게이트도 거부합니다.

값은 정상인데 왜 글자가 네모로 보이나요?

허용 범위의 값이라고 모두 현재 정의된 문자이거나 화면에 그릴 수 있는 문자는 아닙니다. 미할당 위치·비문자·제어 문자도 있고, 글꼴이 특정 문자를 지원하지 않을 수 있습니다. 이 도구는 서로게이트를 뺀 스칼라 값의 변환을 제공하며, 글꼴 지원이나 사용 중인 시스템의 입력 허용 여부는 판정하지 않습니다.

  • 네모 모양은 지원 글꼴이 없다는 표시일 수 있습니다.
  • 문자별 목록은 처음 80개까지 표시하지만 결과와 복사는 전체를 포함합니다.
  • 브라우저의 텍스트 입력칸에서는 CRLF가 LF로 바뀔 수 있어 원본 파일의 줄 끝 바이트를 그대로 검사하는 용도로는 적합하지 않습니다.

유니코드 변환 자주 묻는 질문

한글 가의 유니코드는 무엇인가요?

완성형 한글 가의 코드포인트는 U+AC00이며 10진수로 44032입니다. 문자 → U+에 가를 입력하면 확인할 수 있습니다.

U+AC00을 한글로 바꾸려면 어떻게 하나요?

U+ → 문자 방향에서 U+AC00을 입력하면 가가 나옵니다. U+AC00 U+0041을 입력하면 가A가 됩니다.

이모지도 문자와 코드포인트를 왕복 변환할 수 있나요?

네. 😀는 U+1F600으로 왕복 변환합니다. 👩‍💻처럼 여러 값이 이어진 이모지는 U+1F469 U+200D U+1F4BB를 모두 입력해야 같은 구성을 복원할 수 있습니다.

공백과 줄바꿈은 어떤 값으로 입력하나요?

일반 공백은 U+0020, 탭은 U+0009, 줄바꿈 LF는 U+000A입니다. U+0041 U+000A U+0042를 변환하면 A와 B가 서로 다른 줄에 놓입니다.

U+ 뒤에 소문자나 짧은 숫자를 써도 되나요?

네. u+ac00과 U+AC00은 모두 “가”로 변환합니다. U+41도 A로 인식하며, 문자 → U+ 결과는 최소 네 자리인 U+0041로 표시합니다.

U+D800을 입력했더니 왜 오류가 나나요?

U+D800은 UTF-16의 서로게이트 영역에 속합니다. 이 영역의 값은 단독 스칼라 값이 아니므로 문자로 복원하지 않습니다. 😀를 원하면 서로게이트 쌍 대신 U+1F600을 입력하세요.

똑같이 보이는 한글의 코드포인트가 다른 이유는 무엇인가요?

완성형 가는 U+AC00 하나이고, 자모로 조합한 가는 U+1100과 U+1161 두 개입니다. 이 도구는 입력을 정규화하지 않아 원래 구성의 차이가 그대로 나타납니다.

입력한 문자는 어디에 저장되나요?

이 도구는 입력을 자동 저장하거나 변환을 위해 서버로 보내지 않습니다. 현재 브라우저에서 변환하며 새로고침하면 입력이 사라집니다. 필요한 결과는 먼저 복사해 두세요.

유니코드 정의를 확인한 자료

코드포인트 표기와 스칼라 값 범위는 Unicode 표준 정의를 따릅니다. 그래핌 클러스터 문서는 화면에서 한 글자로 보이는 단위와 코드포인트의 차이를 설명합니다. 개별 문자의 글꼴 지원 여부는 변환 범위와 별개입니다.

함께 쓰면 좋은 텍스트 도구

Roberin
센스 있는 개발자
창의적이고 실용적인 툴로 더 나은 세상을 만드는 센스 있는 개발자, Roberin입니다. 기술은 모두를 위한 것, 함께 더 편리한 세상을 만들어 가요! 😊
문의 양식
확인에 필요한 이야기만 남겨주세요.
답장이 필요한 경우 이메일을 함께 적어주세요. 오류 제보라면 페이지 주소, 입력값, 기대한 결과와 실제 결과를 적어주시면 확인이 빨라집니다.