필요한 툴을, 바로 쓸 수 있게

텍스트 ↔ UTF-8 16진수 변환기

텍스트나 16진수를 입력하면 옆에 변환 결과가 나타납니다. 가운데 방향 전환을 누르면 결과를 다시 원문으로 확인할 수 있습니다.

브라우저 안에서 변환
공백·줄바꿈도 함께 변환
두 자리 = 1바이트
유니코드 문자0스칼라 값 기준
UTF-8 바이트0공백·줄바꿈 포함
16진수 자릿수0구분자 제외

입력하면 바로 변환합니다. 예시로 먼저 확인해 보세요.

ROBERIN 기준필요한 툴을,
바로 쓸 수 있게.
  • 바로 보이는 화면입력 위치와 결과 위치를 또렷하게 둡니다.
  • 결과 먼저핵심 결과를 앞에 두고, 과정은 필요할 때만 보여줍니다.
  • 요구 줄이기가입이나 불필요한 정보 입력 없이 바로 쓰게 합니다.
Roberin

글자와 UTF-8 바이트를 정확히 읽는 방법

텍스트 ↔ UTF-8 16진수 변환기는 글자를 UTF-8 바이트 코드로 바꾸거나, 16진수로 적힌 바이트를 글자로 복원하는 도구입니다. 한글·영문·이모지를 입력하면 바이트마다 두 자리 16진수로 표시합니다. 로그에 찍힌 값이나 프로그램에서 전달받은 문자열의 실제 바이트를 확인할 때 사용할 수 있습니다.

텍스트 모드에서는 공백과 줄바꿈까지 데이터로 취급합니다. 16진수 모드에서는 바이트 사이의 공백을 구분자로 읽고, 잘못된 형식과 UTF-8 오류를 따로 알려 줍니다. 변환 결과 아래에서 문자 수와 바이트 수를 비교하고 글자별 코드를 펼쳐 보세요.

16진수 두 자리가 한 바이트입니다

16진수는 0부터 9까지의 숫자와 A부터 F까지의 문자로 값을 적는 방법입니다. 한 바이트는 8비트이며 00부터 FF까지, 십진수로는 0부터 255까지의 값을 담습니다. 이 도구는 바이트마다 두 자리를 채우고 사이에 공백을 넣습니다.

  • A는 UTF-8에서 41, 숫자 문자 1은 31입니다. 숫자의 크기를 16진수로 바꾸는 계산과는 다릅니다.
  • 0A처럼 첫 자리가 0인 바이트도 두 자리로 유지합니다. 출력의 공백은 읽기 위한 구분자입니다.

텍스트를 넣고 결과를 반대로 확인하세요

텍스트 → 16진수를 선택한 뒤 입력창에 원문을 넣으면 결과가 바로 바뀝니다. 결과 복사로 값을 옮기거나 방향 전환을 눌러 방금 만든 바이트를 원문으로 되돌릴 수 있습니다. 예시는 한글·영문·이모지·줄바꿈을 함께 보여 줍니다.

  • 일반 텍스트는 첫 번째 모드, 로그에서 복사한 바이트 코드는 16진수 → 텍스트 모드를 선택합니다.
  • 방향 전환은 현재 결과를 새 입력으로 옮깁니다. 모드 버튼만 누르면 기존 입력 내용은 유지됩니다.

한글 한 글자는 보통 세 바이트입니다

UTF-8은 유니코드 문자를 1~4바이트로 표현합니다. 영문 알파벳과 숫자는 1바이트, 완성형 한글 음절은 3바이트입니다. 이모지는 한 문자에 4바이트가 쓰이기도 하고 여러 문자를 이어 하나의 그림처럼 표시하기도 합니다.

  • 한 → ED 95 9C, 글 → EA B8 80이므로 한글은 2문자·6바이트입니다.
  • A😀는 41 F0 9F 98 80으로, 2문자·5바이트입니다.

붙여 쓴 값과 공백으로 나눈 값을 읽습니다

16진수 입력은 대문자와 소문자를 모두 받습니다. ED959C처럼 붙여 써도 되고 ED 95 9C처럼 바이트 사이를 띄워도 됩니다. 탭과 ASCII 줄바꿈도 구분자로 사용할 수 있지만 한 바이트의 두 자리 사이를 나누면 오류가 납니다.

  • ED95 9C와 ed 95 9c는 모두 한으로 복원됩니다. E D는 완전한 바이트가 아니므로 거부합니다.
  • 0xED, \xED, %ED, 쉼표와 따옴표는 자동 제거하지 않습니다. 바이트 값만 입력하세요.

공백·줄바꿈·BOM도 원문의 일부입니다

공백은 20, 탭은 09, 줄바꿈 LF는 0A입니다. CRLF 줄바꿈은 0D 0A로 두 바이트를 씁니다. 맨 앞의 BOM은 EF BB BF이며 복원할 때도 U+FEFF 문자로 유지합니다. 눈에 보이는 문장이 같아도 이 값들이 다르면 바이트도 달라집니다.

  • 16진수 입력의 구분자 공백은 무시하지만 바이트 20으로 표현된 공백은 결과에 남습니다.
  • 브라우저 입력창은 붙여 넣은 줄바꿈을 LF로 정리할 수 있습니다. CRLF 자체를 살펴보려면 0D 0A를 16진수로 입력하세요.

글자별 바이트에서 숨은 차이를 찾으세요

펼쳐 볼 수 있는 표는 유니코드 문자마다 코드 포인트와 UTF-8 바이트를 함께 보여 줍니다. 코드 포인트는 U+D55C처럼 문자의 번호를 적은 것이고, ED 95 9C는 그 문자를 UTF-8로 저장한 바이트입니다. 바이트 위치는 첫 바이트를 0으로 세며 앞 12문자까지만 표시합니다.

  • 공백, 탭, 줄바꿈과 BOM은 읽을 수 있는 이름으로 표시합니다.
  • 문자 수는 유니코드 스칼라 값 기준입니다. 결합 문자나 가족 이모지처럼 화면에서 한 글자로 보이는 조합도 여러 문자로 셀 수 있습니다.

형식이 맞아도 UTF-8이 아닐 수 있습니다

FF는 올바른 16진수 바이트이지만 UTF-8 텍스트로는 유효하지 않습니다. ED 95처럼 한글 바이트의 끝이 잘려도 복원할 수 없습니다. 이 도구는 잘못된 바이트를 �로 바꾸어 보여 주지 않고 변환을 멈춥니다.

  • 한 자리만 빠졌다면 원본에서 다시 복사하고, EUC-KR이나 UTF-16 자료라면 원래 인코딩을 확인하세요.
  • 짝이 맞지 않는 UTF-16 서로게이트 문자도 인코딩 전에 거부해 원문이 조용히 바뀌지 않도록 합니다.

UTF-8·유니코드·16진수는 역할이 다릅니다

유니코드는 문자에 번호를 부여하는 체계이고 UTF-8은 그 문자를 바이트로 저장하는 방식입니다. 16진수는 그 바이트 값을 읽기 쉽게 적는 표기입니다. 같은 한글도 EUC-KR 등 다른 인코딩에서는 바이트가 달라지므로 UTF-8 결과를 그대로 대신 쓸 수 없습니다.

  • 16진수 변환은 암호화가 아닙니다. 결과만 있어도 원문을 복원할 수 있습니다.
  • 이미지·압축 파일처럼 임의의 바이너리 데이터를 텍스트로 복원하는 도구는 아닙니다.

복사 전에는 원문과 바이트 수를 확인하세요

변환은 현재 브라우저에서 처리하며 입력한 텍스트를 변환용 서버로 보내지 않습니다. 원문을 자동으로 다듬거나 유니코드 정규화를 적용하지 않으므로, 화면에서 비슷해 보이는 조합도 다른 결과를 낼 수 있습니다. 복사한 값은 받을 프로그램이 요구하는 표기와 맞는지 확인하세요.

  • 텍스트 입력은 UTF-16 기준 100,000자리, 16진수 입력은 구분자 포함 1,200,000자리까지 처리합니다. 긴 자료는 나누어 사용하세요.
  • 결과의 16진수 자릿수는 구분자를 제외한 수로, UTF-8 바이트 수의 두 배입니다.

UTF-8 16진수 변환 자주 묻는 질문

16진수의 대문자와 소문자를 바꿔도 되나요?

네. ED 95 9C와 ed 95 9c는 같은 바이트입니다. 이 도구는 어느 쪽이든 입력받고 텍스트를 변환한 결과는 대문자로 표시합니다.

0x나 역슬래시가 붙은 코드를 바로 넣을 수 있나요?

지원하지 않습니다. 0xED나 \xED 같은 프로그래밍 언어 표기는 제거한 뒤 ED처럼 두 자리 바이트만 입력하세요. 공백·탭·줄바꿈 구분자는 사용할 수 있습니다.

이모지 하나인데 문자 수가 여러 개로 나오는 이유는 무엇인가요?

문자 수는 화면의 그림 개수가 아니라 유니코드 스칼라 값 개수입니다. 피부색이나 결합 문자, ZWJ로 이어진 이모지는 하나처럼 보여도 여러 값으로 구성될 수 있습니다.

EF BB BF를 복원했는데 앞에 아무것도 안 보입니다. 오류인가요?

EF BB BF는 UTF-8 BOM을 나타냅니다. 복원된 U+FEFF는 보통 화면에서 보이지 않습니다. 이 도구는 해당 문자를 유지하며 글자별 바이트 표에 BOM으로 표시합니다.

00도 텍스트로 변환할 수 있나요?

네. 00은 유효한 UTF-8의 NUL 문자입니다. 결과창에서 보이지 않을 수 있지만 바이트 수와 글자별 표에 반영됩니다. 복사한 뒤 다른 프로그램이 이 문자를 처리하는 방식은 달라질 수 있습니다.

한글이 깨지거나 UTF-8 오류가 뜨면 어떻게 하나요?

바이트가 빠지지 않았는지 먼저 확인하세요. 원본 인코딩이 EUC-KR이나 UTF-16이면 원문과 다르게 나오거나 오류가 날 수 있습니다. 이 도구는 인코딩을 추측하거나 다른 문자 인코딩으로 자동 전환하지 않습니다.

같아 보이는 한글이 다른 16진수로 나올 수 있나요?

네. 완성된 음절과 자모를 조합한 문자열은 화면에서 같아 보여도 문자 구성이 다를 수 있습니다. 이 도구는 정규화하지 않고 입력된 문자를 그대로 인코딩합니다.

숫자 255를 입력하면 FF로 바뀌나요?

아닙니다. 이 도구는 숫자를 진법 변환하지 않고 텍스트를 인코딩합니다. 문자 255를 입력하면 각각의 숫자 문자에 해당하는 32 35 35가 나옵니다.

UTF-8과 바이트 표기의 기준 자료

UTF-8 바이트 규칙은 RFC 3629와 WHATWG Encoding 표준을 따릅니다. 선두 BOM 처리와 입력 문자열의 변환은 각각 Encoding 표준·Web IDL을, 같은 모습의 한글 조합 차이는 Unicode 정규화 자료를 참고했습니다.

원문을 살펴볼 때 함께 쓰는 도구

Roberin
센스 있는 개발자
창의적이고 실용적인 툴로 더 나은 세상을 만드는 센스 있는 개발자, Roberin입니다. 기술은 모두를 위한 것, 함께 더 편리한 세상을 만들어 가요! 😊
문의 양식
확인에 필요한 이야기만 남겨주세요.
답장이 필요한 경우 이메일을 함께 적어주세요. 오류 제보라면 페이지 주소, 입력값, 기대한 결과와 실제 결과를 적어주시면 확인이 빨라집니다.