Image to Text (OCR)
신규Extract text from any image, screenshot or photo — free online OCR that runs entirely in your browser, no upload required.
Tips for best results
- • Use high-resolution images (300 DPI+ for scanned docs, HD screenshots)
- • Enable "Auto-enhance" for dark backgrounds or low-contrast images
- • Keep text horizontal — rotated images reduce accuracy
- • PNG preserves quality better than JPEG for text-heavy images
- • First use downloads the OCR engine (~4 MB, cached by your browser)
Runs entirely in your browser. Nothing is uploaded.
이미지에서 텍스트 변환(OCR)이란 무엇이며 왜 유용한가?
이미지에서 텍스트 변환 — 공식적으로는 광학 문자 인식(OCR)이라고 불립니다 — 은 시각적 콘텐츠(사진, 스캔 문서, 스크린샷)와 편집·검색 가능한 디지털 텍스트 사이의 간극을 메워줍니다. 메뉴판을 사진으로 찍거나, 문서 스크린샷을 찍거나, 영수증을 스캔할 때마다, OCR은 그 픽셀 패턴을 복사·편집·검색·공유할 수 있는 텍스트로 변환하는 핵심 기술입니다.
전통적인 OCR은 ABBYY FineReader나 Adobe Acrobat Pro 같은 고가의 데스크톱 소프트웨어가 필요했습니다. 오늘날에는 강력한 OCR이 웹 브라우저에서 직접 실행됩니다 — 소프트웨어 설치 없이, 구독 없이, 이미지를 외부 서버에 업로드하지 않고. 이 무료 OCR 도구는 Google의 오픈소스 Tesseract 엔진의 WebAssembly 포트인 Tesseract.js를 사용하여, 깨끗한 인쇄 텍스트에서 95% 이상의 정확도를 달성합니다. OnlineOCR.net이나 i2OCR 같은 업로드 기반 서비스와 달리, 파일은 절대 기기를 벗어나지 않습니다.
이미지에서 텍스트 변환기 사용법
이 무료 OCR 도구는 세 단계로 사용합니다. 이미지를 업로드 영역에 드래그하거나(클릭하여 파일 선택 또는 Ctrl+V로 클립보드에서 붙여넣기), Tesseract가 이미지를 처리하는 몇 초를 기다리면, 추출된 텍스트가 출력 박스에 나타납니다 — 클릭 한 번으로 복사할 수 있습니다.
JPG, PNG, WebP, GIF, BMP 형식을 지원합니다. 최상의 결과를 위해 대비가 좋은 고해상도 이미지를 사용하세요 — 현대적인 디스플레이의 스크린샷(1920×1080 이상)은 훌륭한 결과를 내고, 스캔 문서는 300 DPI 이상이 좋습니다. 모든 처리는 브라우저에서 로컬로 이루어집니다: 이미지는 절대 기기를 벗어나지 않습니다. 첫 번째 로딩 후 엔진이 캐시되어 완전히 오프라인으로 작동합니다.
무료 온라인 OCR의 일반적인 활용 사례
문서 디지털화가 가장 빈번한 용도입니다: 종이 문서, 이미지만 있는 오래된 PDF, 실물 도서를 검색 가능한 텍스트로 변환하기. 책상 위에 평평하게 놓고 좋은 조명 아래 찍은 인쇄 페이지의 스마트폰 사진도 깨끗한 폰트에서 95% 이상의 정확도를 냅니다. 다시 타이핑하는 것보다 훨씬 빠르고 대부분의 업무 목적에 충분합니다.
스크린샷과 화면 캡처는 이 도구가 진정으로 빛을 발하는 영역입니다 — 텍스트 선택을 허용하지 않는 앱에서 텍스트 복사하기: 잠긴 PDF, 게임 텍스트, 오류 메시지, 비디오 자막. 명함 스캔은 명함 사진에서 연락처 정보를 추출해 연락처 앱에 가져오기. 영수증과 청구서 처리는 비용 보고서를 위한 합계, 날짜, 공급업체 이름 추출. 연구와 인용은 모든 단어를 다시 타이핑하지 않고 책이나 저널의 발췌문을 디지털화하기. 이 모든 사례에서 OnlineOCR.net 같은 업로드 기반 도구에 대한 개인정보 보호 우위는 결정적입니다 — 문서 내용이 브라우저 밖으로 절대 나가지 않습니다.
최고의 OCR 정확도를 얻기 위한 팁
OCR 정확도에 가장 큰 영향을 미치는 요소는 이미지 품질입니다. 해상도가 가장 중요합니다: 300 DPI 스캔의 텍스트는 72 DPI 웹 이미지의 동일한 텍스트보다 훨씬 정확하게 인식됩니다. 문서를 사진 찍을 때는 카메라를 바로 위에서(각도를 주지 않고) 향하게 하고, 그림자 없이 균일한 조명을 확보하고, 선명하게 초점을 맞추세요. 12메가픽셀 이상의 최신 스마트폰은 좋은 조건에서 훌륭한 OCR 소스 이미지를 생성합니다.
스크린샷에는 화면을 스마트폰으로 촬영하는 대신 OS의 네이티브 캡처 도구를 사용하세요 — 스마트폰 사진은 OCR을 저하시키는 모아레 간섭 패턴이 발생합니다. 복잡한 레이아웃(여러 열, 표, 배경 이미지)을 처리할 때는 개별 텍스트 섹션을 따로 추출하면 더 좋은 결과를 얻습니다. 항상 출력을 교정하세요 — 500단어 문서에서 99% 정확도라도 특히 법적, 의료, 재무 맥락에서 몇 가지 오류가 생길 수 있습니다.
UtiloKit OCR과 다른 서비스 비교
OnlineOCR.net과 i2OCR은 업로드 기반 웹 도구입니다 — 사용하기 쉽지만 이미지 파일이 서버로 전송되고, 무료 티어는 속도 제한이 있습니다(OnlineOCR.net은 무료 사용자를 시간당 15페이지로 제한). Adobe Acrobat은 훌륭한 OCR 품질을 제공하지만 월 13~23달러의 유료 구독 뒤에 있습니다. Google Docs OCR은 무료이고 강력하지만 Google 계정이 필요하고 파일을 Google 서버에 업로드합니다.
ABBYY FineReader는 복잡한 상업 문서 OCR의 황금 표준입니다 — 표, 양식, 혼합 레이아웃 스캔을 Tesseract보다 잘 처리하지만 99~199달러이고 로컬 설치나 클라우드 업로드가 필요합니다. 가장 일반적인 OCR 작업(스크린샷, 스캔 페이지, 문서 사진)의 경우, UtiloKit의 브라우저 Tesseract OCR은 정확도 면에서 이 서비스들과 대등하면서도 그 어느 것도 제공할 수 없는 것을 제공합니다: 업로드 없음, 비용 없음, 완전한 개인정보 보호. 이미지는 완전히 본인 기기에서 처리되며 어디에도 전송되지 않습니다.
Tesseract.js 이해하기 — 이 도구를 지원하는 엔진
Tesseract는 세계에서 가장 널리 사용되는 오픈소스 OCR 엔진으로, 1980년대 HP Labs에서 처음 개발되었고 이후 Google이 오픈소스화하여 관리하고 있습니다. Tesseract.js는 그 WebAssembly 포트로, 네이티브 C++ 엔진을 컴파일하여 모든 현대 브라우저에서 네이티브에 가까운 속도로 실행되게 합니다. 버전 4+에서는 LSTM(Long Short-Term Memory) 신경망 백엔드가 도입되어 이전 규칙 기반 접근법에 비해 정확도가 크게 향상되었습니다 — 특히 다양한 폰트, 열화된 텍스트, 노이즈가 있는 문서에서 두드러집니다.
WebAssembly를 통해 브라우저에서 Tesseract를 실행하면 서버 인프라 없이도 네이티브 데스크톱 애플리케이션과 동일한 정확도를 달성합니다. 첫 번째 로딩 시 약 7MB의 엔진 및 언어 모델 파일을 다운로드하며, 이후 로딩은 브라우저 캐시에서 즉시 제공됩니다. 이 아키텍처야말로 이 도구를 진정으로 사적으로 만드는 것입니다: 업로드할 서버가 없는 이유는 모든 연산이 브라우저 탭 내에서 이루어지기 때문입니다.
개인정보 보호, 보안 및 민감 문서 OCR
민감한 문서 OCR — 계약서, 급여명세서, 의료 기록, 여권 사진, 재무 명세서 — 은 이미지가 어디로 가는지 신중하게 고려해야 합니다. OnlineOCR.net, i2OCR, Adobe Acrobat의 웹 OCR 같은 업로드 기반 서비스는 서버에서 이미지를 받습니다. 몇 시간 내에 파일을 삭제한다고 주장하더라도, 문서는 이미 통제를 벗어나 인터넷을 통과하여 내가 제어할 수 없는 하드웨어에서 처리되었습니다.
이 도구는 아키텍처적으로 이미지를 볼 수 없습니다 — 본인의 브라우저 탭에서 Tesseract.js를 실행하는 정적 웹 페이지입니다. 브라우저의 개발자 도구(F12)를 열고 네트워크 탭으로 이동한 후 OCR 작업을 실행하면 확인할 수 있습니다: 발신 파일 전송이 0건임을 볼 수 있습니다. 이는 낯선 사람에게 이메일로 보내지 않을 문서의 OCR에 안전하게 사용할 수 있게 만들어 줍니다 — 기능적으로 낯선 사람은 관여되어 있지 않기 때문입니다.
Frequently asked questions
OCR이란 무엇이고 어떻게 작동하나요?
OCR은 광학 문자 인식(Optical Character Recognition)의 약자로, 텍스트 이미지(타이핑, 인쇄 또는 손글씨)를 복사·검색·편집할 수 있는 기계 판독 가능 텍스트로 변환하는 기술입니다. 엔진은 픽셀 패턴을 분석하고 문자처럼 보이는 영역을 알려진 문자 형태와 매칭하여, 패턴 인식과 언어 모델을 사용해 모호함을 해소합니다. 이 도구를 구동하는 Tesseract 4+와 같은 현대적인 딥러닝 OCR은 수백만 개의 문서 이미지로 훈련된 LSTM 신경망을 사용하여, 깨끗한 인쇄 텍스트에서 98% 이상의 정확도를 달성합니다. 전체 처리 과정이 브라우저에서 로컬로 실행되어, 어떤 서버도 파일을 볼 수 없습니다.
이 도구가 내 이미지를 어딘가에 업로드하나요?
아니요 — 이것이 UtiloKit과 거의 모든 다른 온라인 OCR 서비스의 가장 중요한 차이점입니다. 이 도구는 Tesseract OCR 엔진의 WebAssembly 포트인 Tesseract.js를 사용하여 완전히 브라우저에서 실행됩니다. 이미지는 기기에서 로컬로 처리되어 인터넷을 통해 전송되지 않습니다. 이로써 완전히 비공개이고 GDPR을 준수하며, 엔진 파일이 캐시된 후에는 오프라인으로도 작동합니다.
스마트폰(iPhone, Android)에서도 사용할 수 있나요?
네 — OCR 도구는 iPhone과 iPad의 Safari, Android의 Chrome을 포함한 모든 현대적인 모바일 브라우저에서 작동합니다. 카메라 롤에서 사진을 선택하거나 브라우저의 파일 선택기에서 직접 새 사진을 찍을 수 있습니다. Tesseract 엔진은 기기의 브라우저 탭 안에서 완전히 실행되어 업로드도 서버도 관여하지 않습니다. 처리 속도는 기기의 CPU에 따라 다르지만, 현대적인 스마트폰과 태블릿은 엔진을 무리 없이 처리합니다.
어떤 종류의 이미지가 가장 좋은 결과를 내나요?
다음 조건에서 OCR 정확도가 가장 높습니다: 고해상도(스캔 문서는 최소 300 DPI, 스크린샷은 2배 확대 이상), 텍스트와 배경의 높은 대비(흰 종이에 검은 텍스트가 이상적), 흐림이나 노이즈 없는 선명한 초점, 수평 방향, 깨끗하고 일관된 폰트. 나쁜 조명, JPEG 아티팩트, 작은 텍스트, 장식적인 폰트, 복잡한 배경의 텍스트는 모두 정확도를 낮춥니다.
손글씨 텍스트도 인식할 수 있나요?
Tesseract의 손글씨 인식 능력은 인쇄 텍스트에 비해 제한적입니다. 인쇄체 대문자로 쓴 매우 명확하고 깔끔한 손글씨는 어느 정도 잘 처리하지만, 흘림체는 보통 결과가 좋지 않습니다. 더 나은 손글씨 OCR을 위해서는 Google Cloud Vision API나 Microsoft Azure Computer Vision 같은 전용 서비스가 더 정확하지만, 인터넷 연결이 필요하고 비용이 발생할 수 있습니다.
OCR은 어떤 언어를 지원하나요?
이 도구는 기본적으로 Tesseract의 영어 언어 패키지를 사용합니다. Tesseract 자체는 100개 이상의 언어를 지원합니다 — 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 중국어(간체 및 번체), 일본어, 한국어, 아랍어, 러시아어, 힌디어 등 — 각각 5~20 MB의 학습된 모델 파일이 필요합니다. 다국어 지원은 향후 업데이트에서 추가될 수 있습니다. 현재 다른 언어로 OCR을 사용하려면 Google Docs OCR 또는 ABBYY FineReader가 더 나은 선택입니다.
저품질 이미지에서 OCR 정확도를 어떻게 높이나요?
OCR 정확도를 높이려면: (1) 해상도 높이기 — 기기 접근성 확대 기능을 사용하거나 더 높은 DPI로 스크린샷 찍기. (2) 대비 높이기 — 이미지 편집기에서 대비를 높이고 밝기를 줄여 텍스트가 배경에서 돋보이게 하기. (3) 회색조 또는 흑백으로 변환하기. (4) 노이즈 제거 — 가벼운 선명하게 하기 필터 적용. (5) 기울기 보정 — 텍스트 줄이 수평이 되도록 이미지 회전. (6) 텍스트 영역에 맞게 꼭 자르기. 간단한 전처리만으로도 보통 정확도가 70%에서 95% 이상으로 향상됩니다.
Related tools
모든 도구 보기PDF를 JPG로
PDF 페이지를 원하는 품질의 JPG, PNG 또는 WebP 이미지로 변환하세요 — 모든 작업이 브라우저에서 이루어집니다.
밈 생성기
클래식한 상단/하단 텍스트나 드래그 가능한 텍스트 상자로 밈을 만드세요 — 워터마크 없음, 가입 불필요.
이미지 모서리 둥글게
이미지 모서리를 둥글게 처리하고 투명 PNG로 다운로드 — 브라우저에서.
이미지 압축기
품질 슬라이더로 JPG, PNG, WebP 이미지 압축 — 브라우저에서.
이미지 크기 조정기
가로세로 비율 잠금으로 픽셀 또는 비율 기준으로 이미지 크기 조정.
이미지 변환기
PNG, JPG, WebP 간 이미지 변환 — 품질 제어 포함.