필요한 툴을, 바로 쓸 수 있게

캡처·사진 속 글자를 읽어 주는 이미지 텍스트 추출기

캡처를 붙여넣거나 이미지를 고르면 왼쪽 미리보기의 글자를 읽어 오른쪽 결과창에 보여 줍니다. 필요한 부분만 끌어서 골라 다시 읽고, 결과를 고쳐 복사하거나 TXT로 저장하세요.

인식 설정
인식 언어
줄 정리
이미지

캡처한 화면, 다시 타이핑하지 마세요.

Ctrl + V 또는 + V로 붙여넣기

이곳을 눌러 사진·캡처를 고르거나 이미지를 끌어 놓아도 됩니다.

PNG · JPG · WebP · BMP · GIF · HEIC 1장 · 최대 20MiB · 4,000만 픽셀

미리보기에서 끌어 네모를 그리면 그 부분만 다시 읽습니다.

이미지 전체
글자 수(공백 제외)
줄 수
평균 신뢰도
확인할 단어

이미지는 서버로 보내지 않고 이 브라우저에서 읽습니다. 처음 한 번은 인식 엔진과 언어 데이터(한국어+영어 기준 약 8.5MB)를 이 사이트에서 받고, 다음부터는 브라우저에 저장된 데이터를 씁니다. 인식 결과는 추정값이므로 숫자·이름·계좌번호처럼 중요한 글자는 원본과 대조하세요. 손글씨와 세로쓰기는 정확도가 크게 떨어집니다.

ROBERIN 기준필요한 툴을,
바로 쓸 수 있게.
  • 바로 보이는 화면입력 위치와 결과 위치를 또렷하게 둡니다.
  • 결과 먼저핵심 결과를 앞에 두고, 과정은 필요할 때만 보여줍니다.
  • 요구 줄이기가입이나 불필요한 정보 입력 없이 바로 쓰게 합니다.
Roberin

사진·캡처 속 글자를 텍스트로 옮기는 방법

이미지 텍스트 추출은 사진이나 화면 캡처처럼 글자가 그림으로만 들어 있는 파일에서 글자 모양을 알아보고, 복사하고 고칠 수 있는 텍스트로 바꾸는 일입니다. 흔히 OCR(Optical Character Recognition, 광학 문자 인식)이라고 부릅니다. 캡처한 공지문이나 강의 슬라이드, 찍어 둔 안내문의 문장을 다시 타이핑하지 않고 옮길 때 씁니다.

이 도구는 캡처 화면을 붙여넣거나 사진을 고르는 즉시 한글과 영어를 읽어 오른쪽 결과창에 보여 줍니다. 필요한 부분만 네모로 골라 다시 읽을 수 있고, 인식이 불확실한 단어는 미리보기에 주황 테두리로 표시됩니다. 인식은 이 브라우저 안에서 이루어지므로 이미지가 서버로 전송되지 않습니다.

이미지 속 글자와 복사되는 글자의 차이

웹페이지나 워드 문서의 글자는 컴퓨터가 문자 코드로 알고 있어서 끌어서 선택하고 복사할 수 있습니다. 같은 문장을 캡처하거나 사진으로 찍으면 그 순간부터는 점의 색 정보만 남습니다. 사람 눈에는 똑같이 보여도 컴퓨터에게는 글자가 아니라 그림입니다.

OCR은 이 그림에서 글자 줄을 찾고, 줄을 글자 모양 단위로 나눈 뒤 학습한 글꼴 패턴과 비교해 가장 가능성이 높은 문자를 고릅니다. 그래서 결과는 원본을 그대로 옮긴 것이 아니라 추정입니다. 선명한 캡처에서는 대부분 맞지만, 흐릿한 사진이나 장식이 많은 글꼴에서는 비슷한 모양의 글자로 바뀌는 일이 생깁니다.

캡처를 붙여넣고 텍스트를 가져오기까지

가장 빠른 방법은 붙여넣기입니다. 윈도우에서는 Win+Shift+S, 맥에서는 Command+Shift+Control+4로 화면 일부를 캡처하면 이미지가 클립보드에 들어갑니다. 이 페이지에서 Ctrl+V(맥은 ⌘+V)를 누르면 파일로 저장하지 않아도 곧바로 인식이 시작됩니다.

  • 캡처를 붙여넣거나, 왼쪽 영역에 이미지를 끌어 놓거나, 이미지 선택으로 파일을 고릅니다.
  • 인식 언어를 확인합니다. 처음에는 한국어+영어로 읽습니다.
  • 오른쪽 결과창에 글자가 나오면 주황 테두리 단어를 원본과 비교하고, 틀린 곳은 결과창에서 바로 고칩니다.
  • 일부만 필요하면 미리보기 위에서 끌어 네모를 그립니다. 그 부분만 다시 읽습니다.
  • 전체 복사로 붙여넣을 곳에 옮기거나 TXT 저장으로 파일을 받습니다.

인식 언어는 어떻게 고르나

인식 언어는 이미지에 들어 있는 글자의 종류에 맞춥니다. 한국어+영어는 한글 문장에 영어 단어, 이메일 주소, 제품명이 섞인 일반적인 캡처에 맞는 기본값입니다. 이 설정에서는 숫자와 기호도 함께 읽습니다.

한글만 있는 문서에서 영어 알파벳이 엉뚱하게 끼어든다면 한국어로 바꿔 보세요. 반대로 영어 논문이나 영문 메뉴처럼 한글이 전혀 없는 이미지는 영어로 두는 편이 알파벳 인식이 안정적입니다. 언어를 바꾸면 같은 이미지를 새 설정으로 바로 다시 읽습니다.

  • 한국어+영어: 한글과 영어·숫자가 섞인 캡처, 앱 화면, 공지문
  • 한국어: 한글 위주의 안내문, 책 사진, 한글 문서 캡처
  • 영어: 영어 문서, 영문 웹페이지, 코드가 아닌 영어 문장

필요한 부분만 영역으로 골라 읽기

메신저 캡처에는 프로필 이름과 시간, 버튼 글자까지 함께 들어 있습니다. 이런 이미지는 전체를 읽으면 필요 없는 글자가 결과 사이사이에 섞입니다. 미리보기 위에서 마우스나 손가락으로 끌어 네모를 그리면 그 안의 글자만 다시 읽어 결과창을 바꿉니다.

영역을 고르면 결과창 위의 표시가 이미지 전체에서 선택 영역으로 바뀝니다. 다시 전체를 읽으려면 영역 해제를 누릅니다. 두 단 편집 문서처럼 줄 순서가 섞이는 이미지도 왼쪽 단과 오른쪽 단을 차례로 골라 읽으면 순서대로 옮길 수 있습니다.

작은 글자와 어두운 화면을 읽는 방식

OCR은 글자 높이가 너무 낮으면 획을 구분하지 못해 정확도가 떨어집니다. 이 도구는 먼저 원본 크기로 읽은 뒤, 인식된 줄의 높이 가운데값이 30픽셀보다 낮으면 글자 줄이 약 44픽셀이 되도록 이미지를 최대 3배까지 키워 한 번 더 읽습니다. 처음 읽기에서 글자 줄을 하나도 찾지 못했을 때도 2배로 키워 한 번 더 시도합니다. 확대해서 읽은 결과가 비어 있지 않으면 확대 결과를 씁니다.

다크 모드 앱을 캡처한 이미지처럼 어두운 바탕에 밝은 글자가 있는 경우에는 인식 전에 색을 반전해 밝은 바탕의 어두운 글자로 바꿉니다. 인식 엔진이 흰 바탕의 검은 글자를 가장 안정적으로 읽기 때문입니다. 확대나 반전을 했다면 결과창 아래 안내 문장에 함께 적힙니다.

  • 예: 높이 12픽셀 줄 → 3배 확대(44픽셀 목표이지만 최대 3배)
  • 예: 높이 20픽셀 줄 → 2.2배 확대
  • 예: 높이 32픽셀 줄 → 원본 결과를 그대로 사용
  • 확대 후에도 1,600만 픽셀을 넘지 않는 만큼만 키우므로, 약 1,000만 픽셀 이상인 사진(일반 휴대폰 카메라 원본 등)은 확대하지 않고 원본 크기로 읽습니다. 이런 사진은 필요한 부분만 영역으로 고르면 확대가 적용될 수 있습니다.

주황 테두리와 평균 신뢰도 읽는 법

인식 엔진은 단어마다 이 글자가 맞을 가능성을 0부터 100까지의 점수로 함께 돌려줍니다. 이 점수가 60보다 낮은 단어는 미리보기에서 주황 테두리로 표시하고, 개수를 확인할 단어 칸에 보여 줍니다. 결과창을 처음부터 끝까지 다 대조하기 어렵다면 테두리가 있는 곳부터 보면 됩니다.

평균 신뢰도는 글자 수를 반영한 단어 점수의 평균입니다. 90% 안팎이면 선명한 캡처에서 흔히 나오는 수준이고, 70% 아래로 내려가면 사진이 흐리거나 글꼴이 특이하다는 신호입니다. 다만 점수가 높아도 1과 l, 0과 O처럼 모양이 거의 같은 글자는 틀릴 수 있으므로 숫자와 영문 약자는 따로 확인하세요.

인식한 줄 그대로와 문단으로 잇기

인식한 줄 그대로는 이미지에 보이는 줄바꿈을 그대로 둡니다. 시나 주소, 표의 한 행씩처럼 줄 구분 자체가 의미 있는 글에 맞습니다. 문단으로 잇기는 같은 문단 안에서 화면 폭 때문에 끊긴 줄을 한 문장으로 이어 붙여, 문서나 메일에 붙여넣기 좋게 만듭니다.

두 방식 모두 문단과 문단 사이에는 빈 줄 하나를 둡니다. 문단으로 잇기에서도 •, -, 1. 같은 기호로 시작하는 줄은 목록으로 보고 새 줄에서 시작합니다. 한글 줄은 공백 하나로 잇고, 영어 단어가 줄 끝의 붙임표로 끊겼다면 붙임표를 남긴 채 붙입니다. 이 옵션은 이미지를 다시 읽지 않고 결과만 바로 다시 정리합니다.

결과가 이상하게 나올 때 확인할 것

결과가 비어 있거나 알 수 없는 기호가 많다면 이미지 자체를 먼저 의심해 보는 편이 빠릅니다. 대부분은 아래 경우 중 하나이며, 사진을 다시 찍거나 영역을 좁히면 좋아집니다.

  • 옆으로 누운 사진: 회전 버튼(↺ ↻)으로 글자가 똑바로 서게 돌립니다. 약간 기운 정도는 자동으로 보정합니다.
  • 글자가 흐리거나 초점이 나간 사진: 확대해도 없는 획은 생기지 않으므로 다시 찍는 것이 가장 효과적입니다.
  • 배경 무늬·도장·그림 위의 글자: 글자 부분만 영역으로 좁혀 읽습니다.
  • 장식 글꼴·손글씨·세로쓰기: 정확도가 크게 떨어지며 이 도구가 잘 다루지 못하는 경우입니다.
  • 결과에 이상한 영어가 섞임: 한글만 있는 이미지라면 인식 언어를 한국어로 바꿉니다.
  • 영어 단어에 한글 조사가 바로 붙은 곳(예: English를): 숫자나 기호로 바뀌기 쉬운 자리이므로 결과창에서 직접 고칩니다.

지원하는 이미지와 크기 제한

PNG, JPG, WebP, BMP, GIF(움직이는 GIF는 첫 장면), 아이폰 사진 형식인 HEIC·HEIF를 한 번에 1장 읽습니다. 파일은 20MiB(20,971,520바이트)까지, 이미지 크기는 4,000만 픽셀까지 받습니다. 1,600만 픽셀보다 큰 사진은 가로세로 비율을 유지한 채 1,600만 픽셀로 줄여서 처리합니다.

HEIC 사진은 브라우저에서 PNG로 한 번 바꾼 뒤 읽기 때문에 조금 더 걸립니다. 변환이 실패하면 사진 앱에서 JPG로 내보낸 뒤 다시 선택하세요. PDF, SVG, TIFF 파일은 받지 않습니다. 글자가 들어 있는 PDF라면 이미지로 바꾸지 말고 PDF 텍스트 추출 방식으로 꺼내는 편이 정확합니다.

휴대폰에서 쓸 때와 처리 속도

휴대폰에서는 이미지 선택을 누르면 사진 보관함이나 카메라를 고를 수 있습니다. 붙여넣기 단축키가 없는 대신, 캡처 후 사진 보관함에서 바로 고르면 됩니다. 처음 한 번은 인식 엔진과 언어 데이터(한국어+영어 기준 약 8.5MB)를 이 사이트에서 받으므로 와이파이에서 시작하는 편이 좋습니다.

두 번째부터는 브라우저에 저장된 언어 데이터를 다시 쓰므로 준비 시간이 짧아집니다. 일반적인 휴대폰 캡처 한 장은 최신 기기에서 몇 초 안에 끝나지만, 기기 성능과 이미지 크기, 글자 양에 따라 더 걸릴 수 있습니다. 오래 걸리면 진행 막대의 취소를 누르고 필요한 부분만 영역으로 골라 다시 읽어 보세요.

이미지는 어디로도 전송되지 않습니다

캡처에는 이름, 연락처, 계좌번호처럼 민감한 정보가 담기기 쉽습니다. 이 도구는 인식 엔진을 브라우저 안에서 실행하므로 선택하거나 붙여넣은 이미지와 인식 결과를 서버로 보내지 않습니다. 인터넷으로 받는 것은 처음 한 번의 인식 엔진과 언어 데이터, 그리고 HEIC 사진을 열 때 필요한 변환 도구뿐입니다.

초기화를 누르면 미리보기와 결과창, 선택 영역이 모두 비워집니다. 브라우저 탭을 닫아도 이미지와 결과는 남지 않습니다. 공용 컴퓨터에서는 복사한 내용이 클립보드에 남아 있을 수 있으니 사용 후 다른 글자를 한 번 복사해 두면 안전합니다.

복사하거나 저장하기 전 점검 목록

OCR 결과를 그대로 제출하거나 공유하기 전에 아래 항목만 확인해도 대부분의 오류를 잡을 수 있습니다.

  • 주황 테두리 단어를 원본 이미지와 한 번씩 비교했다.
  • 금액·날짜·전화번호·계좌번호 같은 숫자를 원본과 대조했다.
  • 1과 l, 0과 O, 한글 받침(ㄹ·ㅌ 등) 혼동을 확인했다.
  • 줄 정리 방식을 붙여넣을 곳에 맞게 골랐다.
  • TXT 파일은 한글이 깨지지 않도록 UTF-8로 저장된다는 점을 확인했다.

자주 묻는 질문

캡처한 화면을 저장하지 않고 바로 글자로 바꿀 수 있나요?

네. 윈도우 Win+Shift+S나 맥 Command+Shift+Control+4로 캡처한 뒤 이 페이지에서 Ctrl+V 또는 ⌘+V를 누르면 클립보드의 이미지를 바로 읽습니다. 파일로 저장하거나 올리는 과정이 필요 없습니다.

한글 인식은 얼마나 정확한가요?

선명한 화면 캡처의 일반 글꼴은 대부분 정확하게 읽습니다. 흐린 사진, 장식 글꼴, 손글씨, 세로쓰기는 정확도가 크게 떨어집니다. 결과는 추정값이므로 주황 테두리로 표시된 단어와 숫자는 원본과 비교해 확인하세요.

이미지 일부분만 글자로 뽑을 수 있나요?

미리보기 위에서 마우스나 손가락으로 끌어 네모를 그리면 그 영역만 다시 읽습니다. 다시 전체를 읽으려면 영역 해제를 누르세요.

글자가 작아서 잘 안 읽혀요.

인식된 줄의 높이가 30픽셀보다 낮으면 자동으로 최대 3배까지 확대해 다시 읽습니다. 그래도 부족하면 필요한 부분만 영역으로 골라 보세요. 원본이 흐려 획이 뭉개졌다면 확대로는 복원되지 않으니 더 크게 캡처하거나 다시 찍는 것이 좋습니다.

이미지가 서버에 저장되나요?

아니요. 인식은 브라우저 안에서 이루어지며 이미지와 결과를 서버로 보내지 않습니다. 인터넷으로 받는 것은 처음 한 번 필요한 인식 엔진과 언어 데이터, HEIC 사진을 열 때의 변환 도구뿐입니다.

처음 사용할 때 왜 시간이 걸리나요?

처음에는 인식 엔진과 언어 데이터(한국어+영어 기준 약 8.5MB)를 받아야 하기 때문입니다. 한 번 받은 언어 데이터는 브라우저에 저장되어 다음부터는 준비가 빨라집니다.

아이폰 사진(HEIC)도 되나요?

됩니다. HEIC·HEIF 사진은 브라우저에서 PNG로 바꾼 뒤 읽기 때문에 조금 더 걸립니다. 변환에 실패하면 사진 앱에서 JPG로 내보낸 뒤 다시 선택하세요.

여러 장을 한꺼번에 변환할 수 있나요?

한 번에 1장씩 읽습니다. 휴대폰에서도 메모리 부족 없이 빠르게 처리하기 위한 제한입니다. 여러 장은 한 장씩 붙여넣고 결과를 복사해 이어 붙이면 됩니다.

손글씨나 세로로 쓴 글도 읽나요?

이 도구는 인쇄된 가로쓰기 글자에 맞춰져 있습니다. 손글씨와 세로쓰기는 인식이 거의 되지 않거나 순서가 뒤섞일 수 있어 권하지 않습니다.

TXT로 저장하면 한글이 깨지지 않나요?

TXT 저장은 UTF-8(BOM 포함) 형식과 윈도우식 줄바꿈으로 파일을 만듭니다. 메모장과 한글 프로그램에서 한글이 깨지지 않고 열립니다. 파일 이름은 원본 이름 뒤에 _text가 붙습니다.

문자 인식 방식의 근거

이미지 글자 추출과 함께 쓰는 도구

Roberin
센스 있는 개발자
창의적이고 실용적인 툴로 더 나은 세상을 만드는 센스 있는 개발자, Roberin입니다. 기술은 모두를 위한 것, 함께 더 편리한 세상을 만들어 가요! 😊
문의 양식
확인에 필요한 이야기만 남겨주세요.
답장이 필요한 경우 이메일을 함께 적어주세요. 오류 제보라면 페이지 주소, 입력값, 기대한 결과와 실제 결과를 적어주시면 확인이 빨라집니다.