HTML JPG OCR XML BMP

Searchable PDF

traite les images numérisées ou même les photos de smartphone au format WBMP et crée des documents WBMP contenant du texte reconnu. Pour l’ajouter à votre projet, il vous suffit d’obtenir Aspose.OCR

Aspose Maven Repository ou spécifiez la configuration du référentiel Aspose Maven et installez-le dans votre projet basé sur Maven en ajoutant les configurations suivantes au fichier pom.xml. Pour des exemples Graddle, Ivy, Sbt, consultez notre référentiel .

Maven Dependency
 <dependency>
 <groupId>com.aspose</groupId>
 <artifactId>aspose-ocr</artifactId>
 <version>22.5</version>
 </dependency>

Avec Java OCR et seulement quelques lignes de code, vous pouvez créer une application complète qui convertit une image WBMP en document Searchable PDF :

Créer une instance de la classe AsposeOcr
Appelez la méthode AsposeOCR.RecognizePage
Passez le chemin du fichier WBMP en paramètre
AsposeOCR.RecognizePage renvoie une chaîne ou un fichier de type Searchable PDF

Configuration requise

Avant d’exécuter l’exemple, assurez-vous que Java 2 Platform, Standard Edition (J2SE) 6.0 (1.6) ou version ultérieure est installé sur votre système.

JDK 1.6 ou supérieur est installé.

 //Create API instance
 AsposeOCR api = new AsposeOCR();

 //Prepare rectangles with texts.
 ArrayList rectArray = new ArrayList();

 rectArray.add(new Rectangle(138, 352, 2033, 537));
 rectArray.add(new Rectangle(147, 890, 2033, 1157));

 String result = api.RecognizePage("srcImage.png", rectArray);
 System.out.println("Result with rect: " + result);

WBMP Qu'est-ce que WBMP Format de fichier

WBMP est un format de fichier graphique monochrome optimisé pour les appareils informatiques mobiles. Les images WBMP sont monochromes (noir et blanc) afin que la taille de l'image soit réduite au minimum. Un pixel noir est noté 0 et un pixel blanc est noté 1.

Searchable PDF Qu'est-ce que Searchable PDF Format de fichier

Les fichiers PDF interrogeables conservent l'image numérisée d'origine pour l'affichage, ainsi que le texte OCR dans une couche masquée qui peut être utilisée pour les recherches en texte intégral dans un document ou la mise en surbrillance du texte pour les opérations de copier-coller. La conversion complète de l'OCR en PDF, sans inclure l'image d'origine, ne conservera jamais 100 % de la mise en forme d'origine, en particulier si le document contient de nombreuses images ou une mise en page complexe.

TXT (Fichier de document texte)

Text (Fichier de document texte)

DOC (Documents générés par Microsoft Word)

DOCX (Document Microsoft Word)

XLS (Format de fichier binaire Microsoft Excel)

XLSX (Documents Microsoft Excel)

PDF (Format de document portable (PDF))

Searchable PDF (Graphiques réseau portables consultables)

XML (Langage de balisage extensible)

JSON (Notation d'objet JavaScript)

Aspose.OCR pour Java

Overview

Maven Dependency

Configuration requise

WBMP Qu'est-ce que WBMP Format de fichier

Searchable PDF Qu'est-ce que Searchable PDF Format de fichier