Umi-OCR
Umi-OCR
Active

Umi-OCR

Umi-OCR est une application de bureau OCR hors ligne gratuite sous licence MIT pour Windows et Linux, couvrant les captures d'écran, les images par lots, les PDF, les QR/codes-barres et les plugins de formule en option. Ce guide compare les versions Paddle et Rapid, la confidentialité, les tests de précision, l'assurance qualité de la mise en page/PDF, l'automatisation et les alternatives.

95

Views

0

Likes

Jan 2026

Added

github.com

Website

Tags

Umi-OCROCR offlineOCR gratuitOCR open sourceOCR capture écranOCR PDFOCR local

Product Preview

A quick visual look at Umi-OCR before you visit the official site.

Published 1/21/2026
Umi-OCR screenshot

Editorial Review

About Umi-OCR

Umi-OCR est une application de bureau gratuite et open source permettant de reconnaître du texte localement sous Windows et Linux. Il prend en charge la capture d'écran, les images par lots, le traitement de documents/PDF, les PDF double couche consultables, les codes QR/barres et les plugins de moteur en option tels que la reconnaissance de formules. Le référentiel officiel utilise la licence MIT et distribue des versions portables avec des sommes de contrôle.

Son plus grand avantage est la confidentialité opérationnelle : un moteur local configuré peut traiter les documents sans envoyer leurs pixels à un service OCR hébergé. Cela ne rend pas toutes les actions environnantes hors ligne. Les téléchargements, les vérifications de mises à jour, les plugins tiers, les interfaces HTTP configurées par l'utilisateur, les dossiers synchronisés ou la traduction en aval peuvent créer des chemins de réseau ou de partage de données. Vérifiez la configuration exacte avec un moniteur réseau lorsque la confidentialité est importante.

Official Umi-OCR logo
Umi-OCR est un atelier OCR local plutôt qu'un service cloud de compréhension de documents. Le résultat de la reconnaissance doit toujours être vérifié par rapport aux pixels sources.

Quel flux de travail chaque fonctionnalité résout-elle ?

ModeMeilleure utilisationRésultats/preuvesPrincipale limite
Capture d'écran ROCCopier du texte à partir d'une application ou d'une imageTexte reconnu immédiatementPetit texte de l'interface utilisateur et artefacts de mise à l'échelle
OCR d'images par lotsScans, reçus et dossiers de pagesTexte par fichier avec paramètres reproductiblesOrdre de lecture sur des mises en page complexes
Document/PDFArchives et livres scannésExportation de texte ou PDF double couche consultableTableaux, notes de bas de page et alignement du texte masqué
QR/code-barresDécoder les symboles lisibles par machineCharge utile affichée pour examenLa charge utile peut être une URL malveillante
Plugin de formuleConvertir des régions mathématiques isoléesReprésentation de type LaTeXLes symboles et la structure nécessitent une vérification visuelle
Interface HTTPAutomatisation/intégration localeRésultat OCR lisible par machinePeut exposer des documents s'ils sont liés au-delà de localhost

Le pipeline OCR et ses erreurs indépendantes

 page/écran source
         |
   recadrer + faire pivoter + redresser
         |
         v
   boîtes de détection de texte
         |
         v
   reconnaissance de ligne
         |
         v
 tri de la disposition / ignorer les régions
         |
   .-----+-----------.
   v v
 PDF consultable en texte brut
   |                 |
 vérification humaine : noms, nombres, négation, ordre de lecture

La détection peut manquer une région même lorsque la reconnaissance est précise. La reconnaissance peut mal lire un caractère à l’intérieur d’une case correcte. Le tri par mise en page peut organiser les lignes correctes dans le mauvais ordre. Un PDF consultable peut sembler visuellement identique tandis que son calque de texte invisible contient des erreurs. Inspectez chaque couche séparément au lieu de traiter l’apparence lisible de la page comme l’exactitude de l’OCR.

Constructions Paddle contre Rapid

Les notes de version officielles décrivent le package Paddle comme étant plus rapide/plus gourmand en ressources et adapté aux machines plus puissantes, tandis que la version Rapid utilise moins de mémoire et a une compatibilité CPU plus large mais peut être plus lente. Le texte d'une version plus ancienne avertissait spécifiquement que Paddle pourrait échouer sur certains processeurs Pentium, Celeron et Atom. Les artefacts v2.1.5 actuels répertorient un package Windows Rapid et un package Linux Paddle ; les ressources disponibles peuvent varier selon la version, alors consultez la page en direct.

ChoixCommencez ici quandRéférenceSignal de repli
Construction de pagaieProcesseur compatible moderne et volume de documents plus élevéPages/minute, RAM maximale et précisionErreur d'initialisation, incompatibilité ou pression mémoire
Construction rapideAppareil Windows plus ancien/avec moins de ressourcesMême ensemble de tests et même temps de correction de bout en boutDébit trop lent pour le volume
Paquet LinuxEnvironnement de bureau x64 pris en chargeComportement de la bibliothèque, de la police, du presse-papiers et de la captureÉchecs de dépendance spécifiques à la distribution
Docker/environnement d'exécutionServeur contrôlé ou déploiement reproductibleAPI exposition, volumes, CPU et démarrage à froidFonctionnalités de bureau ou intégration matérielle nécessaires

Ne choisissez pas uniquement en fonction de la taille de l'emballage. Exécutez 50 pages représentatives et mesurez l’erreur de caractère, les régions manquées, le temps de traitement, la mémoire et la correction manuelle. Le moteur le plus précis peut être plus lent mais moins cher s'il enregistre l'examen ; le moteur plus rapide peut gagner pour des pages propres et répétitives.

Téléchargez et installez en toute sécurité

Utilisez la page de version officielle de GitHub ou les miroirs qui y sont nommés. Comparez le SHA-256 téléchargé avec la valeur publiée pour l'actif exact. La version v2.1.5 a examiné les valeurs SHA-256 répertoriées pour les archives Windows Rapid et Linux Paddle. Un auto-extractible .7z.exe peut être ouvert comme archive ; inspectez-le et analysez-le conformément à la politique de l’organisation avant son exécution.

Le logiciel portable écrit toujours les paramètres et les journaux. v2.1.5 journaux ajoutés sous Données/journaux UmiOCR, avec une gravité enregistrée configurable. Examinez les journaux avant de traiter les secrets : les chemins de fichiers, les erreurs ou les extraits reconnus peuvent devenir des données conservées. Protégez l’intégralité du répertoire de données UmiOCR, les sauvegardes et les résultats exportés.

Créer un benchmark OCR spécifique au document

Créez une vérité terrain à partir de pages vérifiées manuellement. Échantillonnez les conditions les plus difficiles réellement attendues, pas une capture d'écran nette. Incluez plusieurs scripts, petites polices, inclinaison, photos de téléphone, faible contraste, tampons, écriture manuscrite, texte vertical, colonnes mixtes, tableaux et pages avec en-têtes/pieds de page.

MétriqueCe qu'il attrapePourquoi c'est insuffisant seul
Taux d'erreur de caractèreInsertions, suppressions et substitutionsUn chiffre erroné peut avoir plus d’importance que de nombreuses erreurs de ponctuation
Taux d'erreur de motsConvivialité au niveau des motsMauvais pour les scripts sans limites de mots simples
Rappel de régionBlocs de texte complètement manquésNe note pas le contenu reconnu
Précision de l'ordre de lectureSéquencement des colonnes et des notes de bas de pageNécessite une vérité fondamentale structurelle
Précision du champ critiqueNoms, totaux, dates, identifiants et négationSpécifique au domaine, mais essentiel aux décisions
Procès-verbal/page de correctionCoût réel du flux de travailDépend des compétences et de l'interface du réviseur

Définissez l’acceptation par cas d’utilisation. L'indexation de la recherche peut tolérer des erreurs modestes ; une clause contractuelle, une valeur médicale ou le total de la facture peuvent nécessiter une double saisie ou un examen qualifié. Ne déduisez jamais « 99 % de précision » à partir d'une langue, d'un modèle ou d'une distribution de numérisation différents.

La préparation des images surpasse souvent le changement de modèle

Faites pivoter vers la bonne orientation, recadrez les bordures non pertinentes, utilisez une résolution suffisante et une perspective correcte sur les photos du téléphone. Préservez une source intacte. Évitez les seuils agressifs qui effacent les caractères fins, les points décimaux ou les signes diacritiques. Testez les niveaux de gris, le contraste et la binarisation sur les copies.

ProblèmeExpérience de prétraitementRisque
Analyse asymétriqueRedresser tout en préservant les bords de la pageL'interpolation brouille le petit texte
Photo en perspectiveCorrection aux quatre coinsLes mauvais coins déforment les colonnes
Faible contrasteContraste local sur une copieLa texture du papier devient de faux traits
Filigrane/en-têteUtilisez les régions ignorées ou les règles de post-filtrageLa règle peut supprimer le texte répété légitime
Petits personnagesNouvelle numérisation à une résolution optique plus élevéeLa mise à l'échelle ne peut pas récupérer les détails manquants
Écriture manuscriteUtilisez une alternative spécialisée en écriture manuscriteL'OCR de texte imprimé peut produire des absurdités confiantes

Reconnaissance multilingue

Installez ou sélectionnez la bibliothèque de langue appropriée pour le document. Un modèle multilingue large peut reconnaître des écritures mixtes mais confondre des caractères visuellement similaires ; un modèle linguistique plus étroit peut améliorer la précision lorsque la langue est connue. Testez les confusions latin/cyrillique, les variantes chinoises/japonaises, la ponctuation, les accents et l'ordre de droite à gauche.

L'OCR n'est pas une traduction. Conservez le texte source reconnu, puis traduisez-le dans une étape distincte avec son propre glossaire et sa propre révision. Si la traduction utilise un modèle cloud, le flux de travail n'est plus entièrement local même si l'OCR était hors ligne.

Mises en page complexes et trieur d'arbres à lacunes

Umi-OCR v2.1 a introduit l'analyse de mise en page réécrite décrite comme un algorithme de tri par arbre vide pour les documents multi-colonnes. Testez les journaux avec des barres latérales, des journaux, des formulaires, des notes de bas de page et des légendes. Une reconnaissance visuellement correcte peut toujours entrelacer les colonnes ou attacher une légende à la mauvaise image.

  • Comparez l'ordre du texte brut à un chemin de lecture humain.
  • Vérifiez si les en-têtes et les pieds de page sont exclus de manière cohérente sans supprimer le corps du texte.
  • Conservez les limites et les coordonnées des pages lorsque la citation en aval nécessite une traçabilité.
  • Utilisez des analyseurs de tableaux/documents spécialisés lorsque la structure des cellules doit être préservée.

PDF double couche consultables

Un PDF double couche conserve les images des pages et superpose une couche de texte invisible pour la recherche, la copie et l'indexation. Les notes de version Umi-OCR indiquent que la génération est prise en charge à partir des fichiers PDF originaux ; d'autres formats de documents importés peuvent produire du texte mais pas nécessairement un PDF reconstruit. Confirmez le comportement exact de la version.

Contrôle qualitéCommentConséquence de l'échec
Fidélité visuellePages rendues par comparaison de pixelsModifications de la page d'archives
Alignement du texteSélectionner/copier des lignes sur la pageMauvais texte à proximité copié
Ordre de lectureExtraire la page entière et comparerLes lecteurs d’écran/extraits de recherche deviennent incohérents
Nombre de pages/rotationContrôles automatisés et visuelsPages manquantes ou inversées
Taille du fichierComparer l'original/la sortie et la compressionArchive ingérable ou image dégradée
Sécurité des PDFAnalyser les pièces jointes/scripts et utiliser la visionneuse isoléeLes entrées malveillantes restent dangereuses

Les codes QR et les codes-barres sont des données non fiables

Décodez d’abord et affichez la charge utile littérale ; n'ouvrez pas automatiquement une URL, ne rejoignez pas le Wi-Fi, n'envoyez pas d'e-mail ou n'exécutez pas une action d'application. Normalisez les domaines similaires, bloquez les schémas dangereux et analysez les liens de manière indépendante. Pour l'inventaire ou les paiements, vérifiez les chiffres de contrôle et comparez-les avec un enregistrement fiable.

La reconnaissance de formule nécessite une vérification sémantique

Des plugins facultatifs peuvent convertir des images de formule en texte de type LaTeX. Vérifiez les exposants, les indices, les signes moins, les symboles de multiplication, les matrices, les parenthèses, les lettres grecques et l'alignement des équations. Compilez le résultat et comparez-le visuellement, puis demandez à un expert du domaine d'en vérifier la signification. Un personnage visuellement similaire peut inverser un résultat.

Automatisation et sécurité de l'interface HTTP

La capacité HTTP locale de Umi-OCR peut connecter une capture d'écran ou une reconnaissance par lots à une autre application. Liez-vous au bouclage par défaut, authentifiez-vous si exposé, limitez les chemins de fichiers et la taille des requêtes et rejetez les URL distantes sauf si cela est explicitement requis. N’exposez jamais un service OCR permissif directement sur Internet.

Mettez les tâches en file d'attente avec des identifiants uniques, stockez les hachages de source, capturez la version du moteur/plug-in et renvoyez les coordonnées/confiance le cas échéant. Définissez des délais d'attente et mettez en quarantaine les images/PDF corrompus. Utilisez un compte/conteneur distinct pour les documents non fiables, car les décodeurs d'images et de PDF ont leur propre surface d'attaque.

Alternatives

OptionsMeilleur ajustementCompromis par rapport à Umi-OCR
Umi-OCRCapture d'écran du bureau privé, OCR par lots et PDFIntelligence documentaire collaborative/cloud limitée
PaddleOCR directementPipeline OCR formé/déployé sur mesurePlus d'ingénierie, un accès plus large aux modèles actuels
TesseractCLI/bibliothèque mature et automatisation déterministeLa qualité de la mise en page et de la langue varie
OCRmyPDFPipeline PDF consultable en ligne de commandeMoins de fonctionnalités de capture de bureau/interface utilisateur
IA pour les documents cloudFormulaires, tableaux, échelles et APIs gérésTéléchargement, coûts récurrents et gouvernance des fournisseurs
LLM multimodalQuestions sémantiques sur quelques pagesPeut halluciner et est plus faible pour les preuves d'extraction exactes
Saisie de données humainesDomaines à enjeux élevés et analyses ambiguësCoût plus élevé mais vérification responsable

Questions fréquemment posées

Umi-OCR est-il gratuit ?

Oui. Le référentiel officiel est sous licence MIT. La distribution, le matériel et le support organisationnel peuvent toujours générer des coûts.

Est-il totalement hors ligne ?

La reconnaissance peut être locale. Vérifiez séparément les mises à jour, les plugins, les dossiers synchronisés, les intégrations HTTP et la traduction en aval.

Est-ce que ça marche sur macOS ?

Le projet officiel distribue principalement les versions Windows et Linux. Les utilisateurs de macOS doivent comparer l'OCR natif, une VM ou un autre outil pris en charge.

Quelle version dois-je choisir ?

Benchmark Paddle d'abord sur du matériel moderne compatible et Rapid sur des processeurs Windows à faibles ressources ou incompatibles ; utilisez le temps de correction comme mesure finale.

Peut-il rendre les PDF numérisés consultables ?

Oui, en utilisant un flux de travail PDF double couche à partir de PDF sources. Inspectez l’alignement du texte masqué et l’ordre de lecture avant l’archivage.

Les résultats OCR peuvent-ils être automatiquement fiables ?

Non pour les données conséquentes. Vérifiez les noms, les nombres, les dates, la négation, les cellules du tableau et tous les champs décisionnels.

Est-ce qu'il reconnaît l'écriture manuscrite ?

Les performances dépendent du moteur/plugin et du script ; utiliser des tests représentatifs et préférer un système spécialisé en écriture manuscrite lorsque cela est nécessaire.

Sources primaires

Dernière révision le 25 juillet 2026. Les moteurs, plugins et packages de plate-forme Umi-OCR évoluent indépendamment. Vérifiez l'actif de version exact, la somme de contrôle, le modèle de langage et le comportement hors ligne de vos documents.

Ready to try Umi-OCR?

Visit the official website to get started

Visit Umi-OCR

Quick Info

Added
1/21/2026
Published
1/21/2026
Updated
9/2/2026

Share This Tool

Have an AI tool to share?

Submit it to AI Dreamhub

Get your product in front of people actively exploring AI tools.

Submit Your Tool