이미지에서 텍스트 추출
사진, 스크린샷, 스캔본에서 글자를 뽑아냅니다 — 브라우저에서 바로. 아무것도 업로드되지 않습니다.
아무것도 업로드하지 않습니다
OCR 엔진이 이 페이지 안에서 돕니다. 신분증, 청구서, 계약서가 기기를 벗어나지 않습니다.
작은 이미지는 자동 확대
너무 작은 스크린샷은 엔진이 필요로 하는 글자 높이까지 키웁니다. 그냥 돌려보내지 않습니다.
여러 언어를 동시에
문자가 섞인 스크린샷을 한 번에 읽습니다. 한 언어만 골라 절반을 잃을 필요가 없습니다.
최대 20장
한 묶음을 통째로 처리하고 결과를 한꺼번에 내려받으세요. 계정도 일일 한도도 없습니다.
요약: 이미지에서 텍스트를 추출하려면 사진이나 스크린샷을 놓고, 그 안에 들어 있는 언어를 고르면 텍스트가 나옵니다. 전부 브라우저에서 이루어지므로 아무것도 업로드되지 않습니다. 스캔본이거나 비스듬히 찍은 사진이라면 정리 옵션을 켜 두세요 — 어떤 도구를 쓰느냐보다 그게 더 중요합니다.
같은 사진인데 사이트마다 결과가 다른 이유
홍보 페이지가 말하지 않는 사실이 있습니다. 이미지에서 텍스트를 추출하는 무료 도구 대부분은 같은 오픈소스 엔진인 Tesseract를 WebAssembly로 컴파일해 돌립니다. 열 곳을 확인했고 그중 최소 다섯 곳은 스스로 그렇게 밝히고 있습니다. 그러니 같은 사진으로 한 사이트는 깔끔한 텍스트를, 다른 사이트는 알아볼 수 없는 문자열을 내놓을 때 엔진이 변수인 경우는 드뭅니다.
어떤 이미지 텍스트 변환에서든 달라지는 것은 엔진에 도달하는 것입니다. 그리고 가장 크게 좌우하는 요인은 아무도 광고하지 않습니다 — 글자의 높이가 몇 픽셀이냐입니다. Tesseract는 소문자 한 글자당 약 20픽셀 높이를 원합니다. 메신저 앱을 두어 번 거쳐 전달된 스크린샷이나 업로드용으로 줄여진 사진은 그 절반인 경우가 흔하고, 그러면 정확도는 절벽처럼 떨어집니다.
다른 도구들이 알려 주는 해법
다시 찍으세요. 테스트한 열 곳에서 결과가 나쁠 때 내놓는 흔한 조언은 더 높은 해상도로 다시 촬영하거나 다시 캡처하라는 것입니다. 타당한 조언이지만, 그 이미지가 가진 유일한 것일 때는 아무 쓸모가 없습니다.
이 페이지는 대신 작은 이미지를 읽기 전에 확대하고, 그렇게 했다는 사실을 알려 줍니다. 테스트에서 400 × 184 픽셀 스크린샷 — 대부분의 도구라면 처음부터 다시 하라고 할 크기 — 이 신뢰도 94%로, 모든 줄이 정확하게 나왔습니다. 확대가 애초에 담기지 않은 디테일을 만들어 내지는 못하지만, 엔진이 설계된 글자 높이를 줄 수는 있습니다.
OCR이 실제로 하는 일, 그리고 하지 않는 일
광학 문자 인식은 이미지 속 밝고 어두운 픽셀의 배열을 보고 그 모양이 어떤 문자를 나타낼 가능성이 가장 높은지 판단합니다. 페이지를 읽거나 이해하는 것이 아니라, 모양을 글자에 하나씩 대응시킬 뿐입니다.
이 구분이 OCR에 대한 거의 모든 불만을 설명합니다. 낯선 글꼴의 단어가 틀리게 나오는 이유, 커피 얼룩 뒤의 글자가 다른 글자가 되는 이유, 그리고 엔진이 존재하지도 않는 단어를 자신만만하게 내놓는 이유 말입니다. 이해가 아니라 패턴 대조입니다.
같은 이유로, 이미지에서 텍스트를 추출할 수 있는 도구는 모두 출력한 단어 하나하나에 신뢰도 점수를 함께 보고합니다. 그 점수는 실제 정보이고, 이 페이지는 그것을 보여 줍니다. 평균이 70% 아래로 떨어지면 확정된 것처럼 건네지 않고 표시를 해 둡니다. 대부분의 도구는 이 수치를 감춥니다.
사람들이 실제로 쓰는 용도
스크린샷과 오류 메시지
누군가 보내 준 스크린샷에서, 또는 선택이 안 되는 오류 창에서 글자를 복사할 때.
영수증과 청구서
찍어 둔 영수증에서 금액과 전표 번호를 뽑아낼 때. 스프레드시트에 다시 입력하지 않아도 됩니다.
찍어 둔 종이 페이지
인쇄물, 책, 양식의 사진을 검색하고 편집하고 붙여 넣을 수 있는 텍스트로 바꿀 때.
애초에 업로드하면 안 되는 서류
신분증, 진단서, 계약서. 남의 서버에 올리지 않는 편이 가장 나은 이미지들입니다.
이미지에서 텍스트를 추출하는 방법
이미지에서 텍스트를 추출하는 과정은 세 단계입니다. 설치도, 계정도, 업로드 단계도 없습니다. 처음 실행할 때 OCR 엔진과 선택한 언어 데이터를 브라우저 캐시로 내려받고, 그 뒤로는 오프라인에서도 동작합니다.
- 1
이미지 추가하기
사진, 스크린샷, 스캔본을 끌어다 놓으세요. JPG, PNG, WebP, BMP, GIF 모두 됩니다. 한 번에 최대 20장까지 추가할 수 있고 차례대로 처리됩니다.
- 2
언어와 정리 옵션 고르기
주된 언어만이 아니라 이미지에 나오는 모든 언어를 선택하세요. 스캔본과 사진은 정리를 켠 채로, 이미 깔끔한 스크린샷은 꺼 두세요. 바로잡기는 페이지를 비스듬히 찍었을 때만 켜면 됩니다.
- 3
추출하고, 확인한 뒤 복사하기
이미지마다 편집 가능한 상자에 텍스트가 신뢰도와 함께 나타납니다. 복사하거나 .txt로 내려받거나 전부 ZIP으로 가져가세요. 결과는 항상 원본과 대조해 훑어보세요 — OCR 출력은 틀렸을 때도 확신에 차 보입니다.
엔진과 언어 데이터는 첫 실행 뒤 캐시되므로, 두 번째 이미지는 곧바로 읽기가 시작됩니다.
성패를 가르는 세 가지
이미지에서 텍스트를 추출할 때 결과가 나쁜 원인은 거의 언제나 이 중 하나이며, 첫 번째가 나머지 둘을 합친 것보다 큽니다.
해상도, 그것도 큰 차이로
Tesseract는 소문자 한 글자당 약 20픽셀 높이를 원하는데, 글자가 가득한 페이지라면 이미지의 짧은 변이 천 픽셀 안팎이라는 뜻입니다. 그 아래로 내려가면 정확도가 가파르게 떨어집니다. 이 페이지는 작은 이미지를 읽기 전에 확대하고 그 사실을 알려 줍니다 — 테스트에서 400 × 184 스크린샷도 모든 줄이 정확했습니다. 다만 흐릿한 사진을 확대하면 더 큰 흐릿한 사진이 될 뿐입니다. 다시 찍을 수 있다면 화면을 페이지로 가득 채우세요. 이 사이트든 다른 어디든, 어떤 설정보다 효과가 큽니다.
대비, 그리고 정리가 생각만큼 도움이 안 되는 이유
엔진은 잉크와 종이를 구분해야 하므로 희끄무레한 스캔본이나 페이지 절반에 드리운 그림자는 일을 어렵게 만듭니다. 정리 옵션은 전체 이미지에 한 번이 아니라 영역별로 계산한 지역 적응 임계값으로 흑백 변환을 합니다. 조명이 고르지 않은 사진에 필요한 것이 바로 이것입니다. 효과의 크기에 대해 솔직히 말하면, 요즘 Tesseract는 내부에서 이미 자체 이진화를 수행하므로 적당히 밝은 사진에서는 차이가 작습니다. 저희 테스트에서는 신뢰도를 몇 포인트 움직였고 가끔 엉뚱한 문자를 하나 덧붙였습니다. 정말 희끄무레한 스캔본과 어두운 휴대폰 사진에서 제값을 하지, 스크린샷에서는 아닙니다.
각도, 찍어 둔 페이지에만 해당
OCR은 가로줄 단위로 읽기 때문에, 몇 도만 기울어도 단어가 엔진이 훑는 픽셀 행을 가로지르며 어긋납니다. 바로잡기는 주된 글자 각도를 감지해 읽기 전에 이미지를 되돌립니다. 손으로 비스듬히 찍은 것에는 켜세요. 스크린샷과 평판 스캔본에서는 꺼 두세요 — 바로잡을 기울기가 없고, 감지는 오차만 들여올 수 있습니다.
솔직한 정리: 가진 것 중 가장 크고 선명한 버전에서 시작하세요. 그다음 스캔본이거나 어두운 사진이면 정리를, 비스듬히 찍었으면 바로잡기를 쓰세요. 둘 중 어느 것도 애초에 너무 작았던 이미지를 구해 내지는 못합니다.
언어가 둘 이상인 스크린샷 — 다른 어떤 도구도 하지 않는 단 한 가지
여기서 많은 사람이 걸립니다. 저희가 시험한 모든 도구는 추출 전에 언어를 하나만 고르라고 합니다. 한국어만 있는 페이지라면 괜찮지만, 현실의 이미지는 상당수가 그렇지 않습니다. 영어 제품명이 섞인 중국어 청구서, 라틴 문자 브랜드명이 나오는 일본어 화면, 영어 URL을 인용한 러시아어 문서처럼요.
언어를 하나만 고르면 이미지에서 다른 문자 체계 영역의 텍스트를 추출하려는 시도는 형편없어집니다 — 엔진이 그 문자를 못 봐서가 아니라, 잘못된 모델에 대조하고 있기 때문입니다. 결국 텍스트의 절반과, 나머지 절반이 있어야 할 자리에 잔뜩 들어찬 무의미한 문자열을 받게 됩니다.
Tesseract는 여러 언어 모델을 동시에 불러올 수 있고, 이 페이지에서는 필요한 만큼 선택할 수 있습니다. 시험한 열 개 도구 중 이를 제공하는 곳은 하나도 없었습니다. 예외 없이 추출 전에 한 언어로 못 박기를 요구합니다. 맞바꾸는 부분도 정직하게 적어 둡니다. 언어가 늘수록 첫 사용 시 내려받는 데이터가 늘고, 여러 개를 불러오면 인식이 다소 느려집니다. 목록 전체가 아니라 이미지에 실제로 나오는 언어만 고르세요.
이것이 하지 못하는 일
OCR에는 실제 한계가 있고, 이미지에서 텍스트를 추출하기 전에 그것을 아는 편이 어떤 설정보다 시간을 아껴 줍니다.
손글씨, 특히 필기체
Tesseract는 인쇄 활자로 학습되었습니다. 또박또박 쓴 대문자 정자체는 때때로 읽히지만, 일반적인 이어 쓴 손글씨는 대개 안 됩니다. 이 페이지가 아니라 엔진의 한계이며, Tesseract 위에 만들어진 모든 무료 도구, 즉 거의 전부에 해당합니다. 다만 그렇게 밝히는 곳은 많지 않습니다.
서식과 레이아웃
얻는 것은 일반 텍스트입니다. 굵게, 기울임, 제목, 색상, 글꼴은 모두 버려집니다. 표는 구조를 잃고 단어의 나열이 되며, 2단 페이지는 단 별로가 아니라 가로로 읽힐 수 있습니다.
정말 못 찍은 사진을 살려 내는 일
정리는 그럭저럭한 이미지를 개선합니다. 애초에 담기지 않은 디테일을 지어내지는 못합니다 — 작은 글자를 흐릿하거나 어둡거나 아주 작게 찍은 사진은 읽을 수 있게 되지 않습니다. 더 높은 해상도로 다시 찍는 편이 어떤 처리보다 낫습니다.
문서를 이해하는 일
보이는 문자를 읽는 순서대로 돌려줄 뿐, 그 이상은 하지 않습니다. 어떤 숫자가 합계이고 어떤 줄이 날짜인지 알지 못합니다. 그에 근거해 무언가를 할 거라면 반드시 확인하세요.
무료 도구 비교
이미지에서 텍스트를 추출하는 도구 열 개를 2026년 9월에 직접 사용해 확인했습니다. 무료 등급의 동작만, 그리고 차이가 나는 항목만 담았습니다 — 전부 무료이고 대부분 브라우저에서 돕니다.
| 도구 | 실행 위치 | 일괄 처리 | 여러 언어 동시에 |
|---|---|---|---|
| 이 페이지 | 내 브라우저 | 최대 20장 | 가능 — 원하는 조합 |
| PixConvert | 내 브라우저 | 한 장씩 | 불가 — 하나만 |
| UtiloKit | 내 브라우저 | 한 장씩 | 불가 — 하나만 |
| OpenConvert | 내 브라우저 | 가능 | 불가 — 하나만 |
| Pixellize | 내 브라우저 | 한 장씩 | 불가 — 하나만 |
| imagetotext.info | 명시 없음 | 유료 등급 | 불가 — 하나만 |
| OnlineOCR.net | 해당 업체 서버 | 로그인 시에만 | 불가 — 하나만 |
솔직하게 정리하면, 여기 있는 이미지 텍스트 추출 도구 중 여럿은 아주 쓸 만하고, 브라우저에서 도는 것들은 그 점에서 인정받을 만합니다 — 한때는 그게 차별점이었지만 이제는 아닙니다. 여전히 갈리는 것은 두 가지입니다. 한 묶음을 통째로 맡길 수 있는지, 그리고 문자가 섞인 이미지를 한 번에 읽을 수 있는지. 뒤쪽에 대해서는 그것이 가능한 다른 도구를 찾지 못했습니다.
완벽한 PDF 도구 모음
문서 작업에 필요한 모든 기능을 갖춘 종합 PDF 도구 모음을 만나보세요
PNG를 PDF로
여러 PNG 이미지를 인쇄 가능한 하나의 PDF로 묶기
JPG를 PDF로
JPG 이미지를 PDF 형식으로 변환
PDF 합치기
여러 PDF 파일을 하나로 합치기
PDF 압축
PDF 파일 용량을 효율적으로 줄이기
PDF를 PNG로
PDF 페이지를 PNG 이미지로 변환
PDF를 JPG로
PDF 페이지를 JPG 이미지로 변환
PDF 텍스트 추출
PDF 파일에서 텍스트 추출
PDF 나누기
PDF를 페이지별로 나누기
PDF 편집
PDF 문서 편집 및 주석 추가
PDF 페이지 정리
PDF 페이지 정리 및 순서 변경
PDF 회전
PDF 페이지를 회전해 영구 저장
페이지 번호
PDF에 페이지 번호를 추가해 영구 저장
PDF 워터마크
실시간 미리보기로 PDF에 텍스트 워터마크 추가
HEIC를 JPG로
아이폰 HEIC 사진을 JPG로 변환
PDF 페이지 삭제
불필요한 페이지를 제거하고 깔끔한 PDF로 다운로드
PDF 페이지 추출
선택한 페이지를 새 PDF 또는 개별 파일로 저장
PDF 서명
서명을 그리거나 입력하거나 업로드해 원하는 페이지에 배치하세요
PDF 크기 조정
페이지 크기를 A4, 레터(Letter) 또는 맞춤 치수로 변경
PDF 자르기
PDF 페이지의 여백을 잘라내고 표시 영역만 남기기
PDF 병합
양식을 읽기 전용으로 — 텍스트는 검색 가능하게 유지하거나 이미지로 잠그기
PDF 메타데이터
작성자, 제목, 날짜 및 기타 메타데이터 보기, 편집 또는 삭제
PDF 흑백 변환
그레이스케일 또는 흑백으로 변환해 컬러 잉크 절약
PDF에서 이미지 추출
PDF에 포함된 사진을 추출해 PNG 또는 JPG로 저장
WebP를 PDF로
WebP 이미지를 PDF로 변환하고 여러 장을 하나의 파일로 합치기
PDF 암호 설정
브라우저에서 바로 PDF에 열기 암호를 설정하세요
PDF 암호 해제
알고 있는 암호나 제한을 브라우저에서 바로 PDF에서 제거하세요
HEIC를 PDF로
아이폰 HEIC 사진을 PDF로 변환
AVIF를 PDF로
AVIF 이미지를 PDF로 변환
TIFF를 PDF로
TIFF 이미지와 스캔을 PDF로 변환
BMP를 PDF로
BMP 비트맵 이미지를 PDF로 변환
PDF OCR
스캔한 PDF를 검색 가능하게, 모두 브라우저 안에서
PDF 마스킹
PDF의 민감한 내용을 완전히 삭제, 모두 브라우저 안에서
이미지 압축
JPEG·PNG·WebP를 한 번에 압축, 모두 브라우저 안에서
이미지 크기 변경
자주 쓰는 프리셋으로 이미지 크기를 한 번에 변경
PNG를 JPG로
PNG 이미지를 일괄로 JPG로 변환하고 내려받기 전에 용량을 확인하세요
JPG를 PNG로
JPG 이미지를 일괄로 PNG로 변환하고 단색 배경을 투명하게 만들 수 있습니다
WebP를 JPG로
WebP 파일을 일괄로 JPG로 변환하고 움직이는 WebP의 모든 프레임을 저장하세요
WebP를 PNG로
WebP를 PNG로 변환해 투명을 유지하거나 단색 배경을 지우세요
이미지를 WebP로
JPG, PNG 등을 일괄로 WebP로 변환하거나 정확한 KB 용량에 맞추세요
SVG를 PNG로
원하는 크기로 SVG를 래스터화하거나 로고 하나로 파비콘 세트를 만드세요
AVIF를 JPG로
어디서나 열리는 JPG로 변환하거나 KB 단위 목표 용량에 맞추세요
PDF 비교
두 PDF 버전 사이에서 무엇이 바뀌었는지 정확히 확인. 업로드 없음
SVG를 JPG로
SVG를 원하는 크기의 JPG로 만들고, 투명한 부분을 어떤 색으로 채울지 고르세요
GIF를 PNG로
정지 프레임 하나를 가져오거나, 움직이는 GIF를 프레임마다 번호가 매겨진 PNG로 나누세요
GIF를 JPG로
투명한 부분을 무엇으로 채울지 고르고, 한 프레임이나 전체를 선택하세요. PNG가 나은 경우는 분명히 알려 드립니다
PDF를 TIFF로
PDF를 하나의 다중 페이지 TIFF로 변환
이미지에서 텍스트 추출
사진과 스크린샷에서 텍스트 추출
이미지에서 텍스트 추출에 관한 질문
이미지에서 텍스트를 추출하고 그 결과를 믿기 전에 사람들이 실제로 묻는 것들.
무료인가요? 제한은 있나요?
무료이며 계정도, 일일 한도도, 워터마크도 없습니다. 한 번에 20장까지, 장당 25MB까지 처리할 수 있습니다. 이 한도는 OCR이 CPU를 많이 쓰고 사용자의 기기에서 돌기 때문이지, 유료 등급 때문이 아닙니다. 끝나면 바로 다음 묶음을 돌리세요.
제 이미지가 어딘가로 업로드되나요?
아니요. OCR 엔진이 이 페이지 안에서 돕니다. 이미지는 사용자의 브라우저가 읽고 전송되지 않습니다. 다른 변환보다 여기서 더 중요한데, 사람들이 OCR에 넣는 이미지가 신분증, 청구서, 진단서, 계약서이기 때문입니다.
처음 쓸 때 몇 메가바이트를 내려받은 이유는?
OCR 엔진과 언어 데이터이며, 한 번만 일어납니다. 인식이 서버가 아니라 로컬에서 돌기 때문에 엔진이 기기까지 와야 합니다. 이후에는 캐시되므로 다음부터는 곧바로 시작하고, 오프라인에서도 동작합니다.
손글씨도 읽나요?
신뢰하기 어렵고, 필기체는 대개 전혀 안 됩니다. 엔진은 인쇄 활자로 학습되었습니다. 또박또박 쓴 대문자 정자체는 읽히기도 합니다. Tesseract 기반 무료 도구 전부에 해당하며, 그것이 대부분입니다.
텍스트가 잘못 나왔습니다. 무엇을 바꿔야 하나요?
해상도가 먼저, 그다음 정리, 마지막이 각도입니다. 이미지에서 텍스트를 추출할 때는 더 크거나 선명한 원본이 어떤 설정보다 낫습니다 — 그것도 큰 차이로요. 그다음 희끄무레한 스캔본이나 어두운 사진이면 정리를, 페이지를 기울여 찍었으면 바로잡기를 켜세요. 이미지에 문자가 둘 섞여 있다면 어느 쪽이 주된지 추측하지 말고 두 언어를 모두 고르세요.
언어가 둘인 이미지도 되나요?
네 — 주된 언어만이 아니라 들어 있는 모든 언어를 고르세요. 엔진이 여러 모델을 동시에 불러와 두 문자 체계를 한 번에 읽습니다. 다른 도구 대부분은 정확히 하나만 고르게 하는데, 섞인 스크린샷이 거기서 반쯤 비어 돌아오는 이유가 그것입니다.
레이아웃이나 표, 굵은 글씨는 유지되나요?
아니요. 출력은 일반 텍스트입니다. 서식, 색상, 글꼴은 버려지고 표는 구조를 잃으며, 여러 단으로 된 페이지는 위아래가 아니라 가로로 읽힐 수 있습니다. 레이아웃을 보존해야 한다면 필요한 것은 추출된 텍스트가 아니라 텍스트 레이어가 있는 PDF입니다.
이미지가 아니라 PDF를 가지고 있다면?
PDF용 OCR 도구를 쓰세요 — 페이지를 그대로 유지합니다. 각 페이지를 렌더링해 읽은 뒤 원본 위에 보이지 않는 텍스트 레이어를 써 넣으므로, 문서는 그대로인데 검색이 가능해집니다. PDF를 먼저 이미지로 바꿔 여기에 넣으면 문서 구조를 잃게 됩니다.
관련 도구
이미지에서 텍스트를 추출하기 전후로 함께 쓰기 좋은 것들. 모두 무료이고 모두 사용자의 기기에서 실행됩니다.
- PDF에 OCR 적용 — 사진이 아니라 문서용 — 검색 가능한 텍스트 레이어를 더하고 페이지는 그대로 둡니다.
- PDF를 텍스트로 — PDF 안에 이미 진짜 텍스트가 있어 꺼내기만 하면 될 때. OCR이 필요 없습니다.
- 이미지 크기 조정 — 너무 작은 스크린샷을 읽기 전에 키우거나, 지나치게 큰 사진을 줄일 때.
- 이미지 압축 — 이미지는 괜찮은데 파일이 커서 보내기 어려울 때.
- PDF를 PNG로 — 글자가 아니라 그림이 필요할 때, PDF에서 페이지를 이미지로 꺼냅니다.