HTML JPG OCR XML BMP

Searchable PDF

verarbeitet gescannte Bilder oder sogar Smartphone-Fotos im TIFF-Format und erstellt TIFF-Dokumente mit erkanntem Text. Um es zu Ihrem Projekt hinzuzufügen, müssen Sie nur Aspose.OCR abrufen.

Aspose Maven Repository oder geben Sie die Aspose Maven Repository-Konfiguration an und installieren Sie es in Ihrem Maven-basierten Projekt, indem Sie die folgenden Konfigurationen zu pom.xml hinzufügen. Beispiele für Graddle, Ivy und Sbt finden Sie in unserem [Repository] ( https://repository.aspose.com/ocr/ ) .

Maven Dependency
 <dependency>
 <groupId>com.aspose</groupId>
 <artifactId>aspose-ocr</artifactId>
 <version>22.5</version>
 </dependency>

Mit Java OCR und nur wenigen Codezeilen können Sie eine voll funktionsfähige Anwendung erstellen, die ein TIFF-Bild in ein Searchable PDF-Dokument konvertiert:

Erstellen Sie eine Instanz der Klasse AsposeOcr
Rufen Sie die Methode AsposeOCR.RecognizePage auf
Übergeben Sie den Dateipfad TIFF als Parameter
AsposeOCR.RecognizePage gibt einen String oder eine Datei vom Typ Searchable PDF zurück

System Anforderungen

Stellen Sie vor dem Ausführen des Beispiels sicher, dass Java 2 Platform, Standard Edition (J2SE) 6.0 (1.6) oder höher auf Ihrem System installiert ist.

JDK 1.6 oder höher ist installiert.

 //Create API instance
 AsposeOCR api = new AsposeOCR();

 //Prepare rectangles with texts.
 ArrayList rectArray = new ArrayList();

 rectArray.add(new Rectangle(138, 352, 2033, 537));
 rectArray.add(new Rectangle(147, 890, 2033, 1157));

 String result = api.RecognizePage("srcImage.png", rectArray);
 System.out.println("Result with rect: " + result);

TIFF Was ist TIFF Datei Format

TIFF oder TIF, Tagged Image File Format, stellt Rasterbilder dar, die für die Verwendung auf einer Vielzahl von Geräten gedacht sind, die diesem Dateiformatstandard entsprechen. Es ist in der Lage, Bilevel-, Graustufen-, Palettenfarben- und Vollfarben-Bilddaten in mehreren Farbräumen zu beschreiben. Es unterstützt sowohl verlustbehaftete als auch verlustfreie Komprimierungsschemata, um zwischen Speicherplatz und Zeit für Anwendungen zu wählen, die das Format verwenden. Das Format ist erweiterbar und wurde mehrfach überarbeitet, was die Aufnahme einer unbegrenzten Menge an privaten oder speziellen Informationen ermöglicht. Das Format ist nicht maschinenabhängig und frei von Grenzen wie Prozessor, Betriebssystem oder Dateisystem.

Searchable PDF Was ist Searchable PDF Datei Format

Durchsuchbare PDF-Dateien behalten das gescannte Originalbild zur Anzeige sowie OCR-Text in einer verborgenen Ebene bei, die für die Volltextsuche in einem Dokument oder zum Hervorheben von Text zum Kopieren und Einfügen verwendet werden kann. Die vollständige OCR-Konvertierung in PDF, ohne das Originalbild, wird niemals 100 % der Originalformatierung beibehalten, insbesondere wenn das Dokument viele Bilder oder ein komplexes Layout enthält.

TXT (Textdokumentdatei)

Text (Textdokumentdatei)

DOC (Von Microsoft Word generierte Dokumente)

DOCX (Microsoft Word-Dokumente)

XLS (Binäres Dateiformat von Microsoft Excel)

XLSX (Microsoft Excel-Dokumente)

PDF (Portables Dokumentenformat (PDF))

Searchable PDF (Durchsuchbare tragbare Netzwerkgrafiken)

XML (Erweiterbare Auszeichnungssprache)

JSON (JavaScript-Objekt-Notation)

Aspose.OCR für Java

Overview

Maven Dependency

System Anforderungen

TIFF Was ist TIFF Datei Format

Searchable PDF Was ist Searchable PDF Datei Format