Umi-OCR
Umi-OCR
Active

Umi-OCR

Umi-OCR은 스크린샷, 배치 이미지, PDF, QR/바코드 및 선택적 수식 플러그인을 포함하는 Windows 및 Linux용 MIT 라이선스 무료 오프라인 OCR 데스크톱 앱입니다. 이 가이드에서는 Paddle 및 Rapid 빌드, 개인 정보 보호, 정확성 테스트, 레이아웃/PDF QA, 자동화 및 대안을 비교합니다.

160

Views

0

Likes

Jan 2026

Added

github.com

Website

Tags

Umi-OCR오프라인 OCR무료 OCR오픈소스 OCR스크린샷 OCRPDF OCR로컬 OCRWindows OCRLinux OCR

Product Preview

A quick visual look at Umi-OCR before you visit the official site.

Published 1/21/2026
Umi-OCR screenshot

Editorial Review

About Umi-OCR

Umi-OCR Windows 및 Linux에서 로컬로 텍스트를 인식하기 위한 무료 오픈 소스 데스크톱 애플리케이션입니다. 스크린샷 캡처, 배치 이미지, 문서/PDF 처리, 검색 가능한 이중 레이어 PDF, QR/바코드 및 수식 인식과 같은 선택적 엔진 플러그인을 지원합니다. 공식 저장소는 MIT 라이센스를 사용하고 체크섬이 포함된 이식 가능한 빌드를 배포합니다.

가장 큰 장점은 운영상의 개인 정보 보호입니다. 구성된 로컬 엔진은 픽셀을 호스팅된 OCR 서비스로 보내지 않고도 문서를 처리할 수 있습니다. 이는 주변의 모든 작업을 오프라인으로 만드는 것은 아닙니다. 다운로드, 업데이트 확인, 타사 플러그인, 사용자 구성 HTTP 인터페이스, 동기화된 폴더 또는 다운스트림 번역을 통해 네트워크 또는 데이터 공유 경로를 만들 수 있습니다. 기밀이 중요한 경우 네트워크 모니터로 정확한 설정을 확인하세요.

Official Umi-OCR logo
Umi-OCR은 클라우드 문서 이해 서비스가 아닌 로컬 OCR 워크벤치입니다. 인식 출력은 여전히 ​​소스 픽셀에 대해 확인되어야 합니다.

각 기능은 어떤 워크플로를 해결합니까?

모드최고의 사용산출물/증거주요한계
스크린샷 OCR앱이나 이미지에서 텍스트 복사하기즉시 인식된 텍스트작은 UI 텍스트 및 크기 조정 아티팩트
배치 이미지 OCR스캔, 영수증 및 페이지 폴더반복 가능한 설정이 포함된 파일별 텍스트복잡한 레이아웃 전체의 읽기 순서
문서/PDF스캔한 아카이브 및 도서텍스트 내보내기 또는 검색 가능한 이중 레이어 PDF표, 각주 및 숨겨진 텍스트 정렬
QR/바코드기계 판독 가능 기호 디코딩검토를 위해 표시된 페이로드페이로드는 악성 URL일 수 있습니다.
수식 플러그인격리된 수학 영역 변환LaTeX와 유사한 표현기호와 구조는 시각적 확인이 필요합니다.
HTTP 인터페이스로컬 자동화/통합기계 판독 가능한 OCR 결과localhost를 넘어 바인딩된 경우 문서가 노출될 수 있습니다.

OCR 파이프라인과 그 독립 오류

 소스 페이지/화면
         |
   자르기 + 회전 + 기울기 조정
         |
         v
   텍스트 감지 상자
         |
         v
   라인 인식
         |
         v
 레이아웃 정렬 / 영역 무시
         |
   ------+------------.
   v v
 일반 텍스트 검색 가능 PDF
   |                 |
 휴먼 체크: 이름, 숫자, 부정, 읽는 순서

인식이 정확하더라도 감지에서는 영역을 놓칠 수 있습니다. 인식 시 올바른 상자 안에 있는 문자를 잘못 읽을 수 있습니다. 레이아웃 정렬로 인해 올바른 줄이 잘못된 순서로 정렬될 수 있습니다. 검색 가능한 PDF는 시각적으로 동일해 보이지만 보이지 않는 텍스트 레이어에 오류가 있을 수 있습니다. 읽을 수 있는 페이지 모양을 OCR 정확성으로 취급하는 대신 각 레이어를 개별적으로 검사하세요.

패들 대 래피드 빌드

공식 릴리스 노트에서는 Paddle 패키지가 더 빠르고 리소스가 많으며 더 강력한 시스템에 적합한 것으로 설명하고 있으며 Rapid 빌드는 메모리를 덜 사용하고 CPU 호환성이 더 넓지만 속도가 느릴 수 있습니다. 이전 릴리스 텍스트에서는 일부 Pentium, Celeron 및 Atom CPU에서 Paddle이 실패할 수 있다고 구체적으로 경고했습니다. 현재 v2.1.5 아티팩트에는 Windows Rapid 패키지와 Linux Paddle 패키지가 나열되어 있습니다. 사용 가능한 자산은 릴리스마다 다를 수 있으므로 라이브 페이지를 확인하세요.

선택이럴 때 여기서 시작하세요벤치마크대체 신호
패들 빌드최신 호환 CPU 및 더 높은 문서 볼륨페이지/분, 최대 RAM 및 정확도초기화 오류, 비호환성 또는 메모리 부족
신속한 구축이전/낮은 리소스 Windows 장치동일한 테스트 세트 및 엔드투엔드 수정 시간볼륨에 비해 처리량이 너무 느림
리눅스 패키지지원되는 x64 데스크탑 환경라이브러리, 글꼴, 클립보드 및 캡처 동작배포판별 종속성 오류
도커/런타임제어된 서버 또는 반복 가능한 배포API 노출, 볼륨, CPU 및 콜드 스타트데스크탑 기능 또는 하드웨어 통합 필요

패키지 크기만으로 선택하지 마십시오. 50개의 대표 페이지를 실행하여 문자 오류, 누락된 영역, 처리 시간, 메모리 및 수동 수정을 측정합니다. 리뷰를 저장하면 엔진이 더 정확할수록 속도는 느려지지만 가격은 더 저렴해질 수 있습니다. 깨끗하고 반복적인 페이지에서는 더 빠른 엔진이 승리할 수 있습니다.

안전하게 다운로드하고 설치하세요

공식 GitHub 릴리스 페이지나 거기에 명명된 미러를 사용하세요. 다운로드한 SHA-256을 정확한 자산에 대해 게시된 값과 비교하세요. v2.1.5 릴리스에서는 Windows Rapid 및 Linux Paddle 아카이브에 대해 나열된 SHA-256 값을 검토했습니다. 자동 추출 .7z.exe 아카이브로 열 수 있습니다. 이를 검사하고 실행하기 전에 조직 정책에 따라 검사합니다.

휴대용 소프트웨어는 여전히 설정과 로그를 기록합니다. v2.1.5에 로그가 추가되었습니다. UmiOCR 데이터/로그, 구성 가능한 저장된 심각도가 있습니다. 비밀을 처리하기 전에 로그를 검토하세요. 파일 경로, 오류 또는 인식된 조각은 보관된 데이터가 될 수 있습니다. 전체 UmiOCR 데이터 디렉터리, 백업 및 내보낸 결과를 보호합니다.

문서별 OCR 벤치마크 구축

수동으로 검증된 페이지에서 Ground Truth를 만듭니다. 깨끗한 스크린샷이 아닌 실제로 예상되는 가장 어려운 조건을 샘플링합니다. 여러 스크립트, 작은 글꼴, 기울어짐, 전화 사진, 낮은 대비, 스탬프, 필기, 세로 텍스트, 혼합 열, 표 및 머리글/바닥글이 있는 페이지를 포함합니다.

미터법잡는 것혼자서는 부족한 이유
문자 오류율삽입, 삭제 및 대체잘못된 숫자 하나가 많은 구두점 오류보다 더 중요할 수 있습니다
단어 오류율단어 수준의 유용성간단한 단어 경계가 없는 스크립트에는 적합하지 않음
지역 리콜완전히 누락된 텍스트 블록인식된 콘텐츠에 점수를 매기지 않습니다.
읽기 순서 정확도열 및 각주 순서구조적 진실이 필요함
임계장 정확도이름, 합계, 날짜, ID 및 부정도메인별로 다르지만 결정에 필수적입니다.
수정 분/페이지실제 작업 흐름 비용리뷰어의 기술과 인터페이스에 따라 다름

사용 사례별로 승인을 설정합니다. 검색 색인 생성은 약간의 오류를 허용할 수 있습니다. 계약 조항, 의료 가치 또는 청구서 총액에는 이중 입력 또는 적격 검토가 필요할 수 있습니다. 다른 언어, 모델 또는 스캔 분포에서 "99% 정확성"을 추론하지 마십시오.

이미지 준비가 종종 모델 전환을 능가합니다.

올바른 방향으로 회전하고, 관련 없는 테두리를 자르고, 휴대폰 사진에 충분한 해상도와 올바른 원근을 사용하십시오. 손길이 닿지 않은 소스를 보존하세요. 얇은 문자, 소수점 또는 발음 구별 부호를 지우는 공격적인 임계값 지정을 피하십시오. 복사본의 회색조, 대비 및 이진화를 테스트합니다.

문제전처리 실험위험
비뚤어진 스캔페이지 가장자리를 유지하면서 기울기를 조정합니다.보간으로 인해 작은 텍스트가 흐려짐
투시 사진네 모서리 교정모서리가 잘못되면 기둥이 왜곡됩니다.
낮은 대비복사본의 부분 대비종이 질감이 잘못된 선이 됩니다.
워터마크/헤더지역 무시 또는 사후 필터 규칙 사용규칙은 적법한 반복 텍스트를 삭제할 수 있습니다.
작은 캐릭터더 높은 광학 해상도로 다시 스캔업스케일링으로는 누락된 세부정보를 복구할 수 없습니다.
필기필기 전문가 대안을 사용하세요인쇄된 텍스트 OCR은 신뢰할 수 있는 넌센스를 출력할 수 있습니다.

다국어 인식

문서에 맞는 언어 라이브러리를 설치하거나 선택하세요. 광범위한 다국어 모델은 혼합된 문자를 인식할 수 있지만 시각적으로 유사한 문자를 혼동할 수 있습니다. 더 좁은 언어 모델은 언어가 알려졌을 때 정확도를 향상시킬 수 있습니다. 라틴어/키릴 문자 혼동 가능 문자, 중국어/일본어 변형, 구두점, 악센트 및 오른쪽에서 왼쪽 순서를 테스트합니다.

OCR은 번역이 아닙니다. 인식된 원본 텍스트를 유지한 다음 자체 용어집과 검토를 통해 별도의 단계로 번역하세요. 번역에서 클라우드 모델을 사용하는 경우 OCR이 오프라인이더라도 워크플로는 더 이상 완전히 로컬이 아닙니다.

복잡한 레이아웃과 간격 트리 분류기

Umi-OCR v2.1에서는 다중 열 문서에 대한 간격 트리 정렬 알고리즘으로 설명된 재작성된 레이아웃 구문 분석을 도입했습니다. 사이드바, 신문, 양식, 각주 및 캡션이 포함된 저널을 테스트하세요. 시각적으로 올바른 인식을 통해 열을 인터리브하거나 잘못된 이미지에 캡션을 첨부할 수 있습니다.

  • 일반 텍스트 순서를 사람이 읽는 경로와 비교합니다.
  • 본문을 제거하지 않고 머리글과 바닥글이 일관되게 제외되는지 확인하세요.
  • 다운스트림 인용에 추적성이 필요할 때 페이지 경계와 좌표를 유지하세요.
  • 셀 구조를 보존해야 하는 경우 특수 테이블/문서 파서를 사용하세요.

검색 가능한 이중 레이어 PDF

이중 레이어 PDF는 페이지 이미지를 유지하고 검색, 복사 및 색인화를 위해 보이지 않는 텍스트 레이어를 오버레이합니다. Umi-OCR 릴리스 노트에는 원본 PDF에서 생성이 지원된다고 명시되어 있습니다. 가져온 다른 문서 형식에서는 텍스트가 생성될 수 있지만 PDF가 반드시 재구성되는 것은 아닙니다. 정확한 버전 동작을 확인하세요.

품질보증 확인어떻게실패 결과
시각적 충실도렌더링된 페이지의 픽셀 비교보관 페이지 변경
텍스트 정렬페이지 전체에서 줄 선택/복사주변 텍스트가 잘못 복사되었습니다.
읽는 순서전체 페이지 추출 및 비교스크린 리더/검색 스니펫이 일관되지 않습니다.
페이지 수/회전자동 및 시각적 검사누락되거나 반전된 페이지
파일 크기원본/출력 및 압축 비교관리하기 어려운 아카이브 또는 저하된 이미지
PDF 안전첨부 파일/스크립트를 스캔하고 격리된 뷰어를 사용하세요.악의적인 입력은 여전히 위험합니다

QR 코드와 바코드는 신뢰할 수 없는 데이터입니다.

먼저 디코딩하고 리터럴 페이로드를 표시합니다. 자동으로 URL을 열거나, Wi-Fi에 연결하거나, 이메일을 보내거나, 앱 작업을 실행하지 마세요. 유사 도메인을 표준화하고, 위험한 계획을 차단하고, 링크를 독립적으로 검사합니다. 재고나 결제의 경우 확인 숫자를 확인하고 신뢰할 수 있는 기록과 비교하세요.

수식 인식에는 의미 확인이 필요합니다.

선택적 플러그인은 수식 이미지를 LaTeX와 유사한 텍스트로 변환할 수 있습니다. 위 첨자, 아래 첨자, 빼기 기호, 곱셈 기호, 행렬, 괄호, 그리스 문자 및 방정식 정렬을 확인하세요. 출력을 컴파일하고 시각적으로 비교한 후 도메인 전문가에게 의미를 확인하도록 하세요. 시각적으로 유사한 문자는 결과를 반전시킬 수 있습니다.

자동화 및 HTTP 인터페이스 보안

Umi-OCR의 로컬 HTTP 기능은 스크린샷이나 일괄 인식을 다른 애플리케이션에 연결할 수 있습니다. 기본적으로 루프백에 바인딩하고, 노출된 경우 인증하고, 파일 경로 및 요청 크기를 제한하고, 명시적으로 필요하지 않은 경우 원격 URL을 거부합니다. 허용되는 OCR 서비스를 인터넷에 직접 노출하지 마십시오.

고유한 ID를 사용하여 작업을 대기열에 저장하고, 소스 해시를 저장하고, 엔진/플러그인 버전을 캡처하고, 가능한 경우 좌표/신뢰도를 반환합니다. 시간 초과를 정의하고 손상된 이미지/PDF를 격리합니다. 이미지 및 PDF 디코더에는 자체 공격 표면이 있으므로 신뢰할 수 없는 문서에는 별도의 계정/컨테이너를 사용하십시오.

대안

옵션최적의 핏Umi-OCR과의 절충
Umi-OCR개인 데스크톱 스크린샷, 일괄 처리 및 PDF OCR제한된 협업/클라우드 문서 인텔리전스
PaddleOCR 직접맞춤형 학습/배포 OCR 파이프라인더 많은 엔지니어링, 더 폭넓은 현재 모델 액세스
테서렉트성숙한 CLI/라이브러리 및 결정적 자동화레이아웃/언어 품질은 다양함
OCRmyPDF명령줄 검색 가능 PDF 파이프라인데스크탑 캡처/UI 기능 감소
클라우드 문서 AI양식, 테이블, 규모 및 관리 APIs업로드, 반복 비용 및 공급자 거버넌스
다중 모드 LLM몇 페이지에 걸친 의미론적 질문환각을 느낄 수 있으며 정확한 추출 증거에 약함
인간 데이터 입력위험도가 높은 필드와 모호한 스캔비용은 높지만 책임 있는 검증

자주 묻는 질문

Umi-OCR은 무료인가요?

그렇습니다. 공식 저장소는 MIT 라이센스를 받았습니다. 유통, 하드웨어 및 조직 지원은 여전히 ​​비용을 발생시킬 수 있습니다.

완전히 오프라인인가요?

인식은 지역적일 수 있습니다. 업데이트, 플러그인, 동기화된 폴더, HTTP 통합 및 다운스트림 번역을 별도로 확인하세요.

macOS에서 작동하나요?

공식 프로젝트는 주로 Windows 및 Linux 빌드를 배포합니다. macOS 사용자는 기본 OCR, VM 또는 기타 지원되는 도구를 비교해야 합니다.

어떤 빌드를 선택해야 하나요?

호환되는 최신 하드웨어에서는 먼저 벤치마크 패들(Benchmark Paddle)을 사용하고 리소스가 적거나 호환되지 않는 Windows CPU에서는 Rapid를 사용합니다. 수정 시간을 최종 측정값으로 사용합니다.

스캔한 PDF를 검색 가능하게 만들 수 있나요?

예, 소스 PDF에서 이중 레이어 PDF 작업 과정을 사용합니다. 보관하기 전에 숨겨진 텍스트 정렬과 읽기 순서를 검사하세요.

OCR 결과를 자동으로 신뢰할 수 있나요?

결과적 데이터의 경우 아니요. 이름, 숫자, 날짜, 부정, 테이블 셀 및 모든 의사 결정 필드를 확인합니다.

손글씨를 인식하나요?

성능은 엔진/플러그인 및 스크립트에 따라 다릅니다. 대표적인 테스트를 사용하고 필요한 경우 필기 전문 시스템을 선호합니다.

1차 소스

최종 검토일: 2026년 7월 25일. Umi-OCR 엔진, 플러그인 및 플랫폼 패키지는 독립적으로 발전합니다. 문서의 정확한 릴리스 자산, 체크섬, 언어 모델 및 오프라인 동작을 확인하세요.

Ready to try Umi-OCR?

Visit the official website to get started

Visit Umi-OCR

Quick Info

Added
1/21/2026
Published
1/21/2026
Updated
9/7/2026

Share This Tool

Have an AI tool to share?

Submit it to AI Dreamhub

Get your product in front of people actively exploring AI tools.

Submit Your Tool