HTML JPG OCR XML BMP
Aspose.OCR  für .NET
Searchable PDF

Konvertieren Sie DJVU in Searchable PDF in C#

Führen Sie eine optische Zeichenerkennung für das DJVU-Dokument durch und speichern Sie Text als DJVU-Dokument mit Aspose.OCR aus der .NET-Bibliothek.

So konvertieren Sie DJVU in Searchable PDF mit C#

Aspose.OCR für .NET ist eine leistungsstarke, aber benutzerfreundliche und kostengünstige Bibliothek zum Konvertieren von DJVU-Bildern in Searchable PDF-Dokumente. Die hochmoderne optische Zeichenerkennungs-Engine unterstützt 26 Sprachen basierend auf Latein, Kyrillisch und Chinesisch und bietet eine überlegene Erkennungsgeschwindigkeit und -genauigkeit, während Sie von Formeln, neuronalen Netzwerken und anderen komplexen technischen Details isoliert werden. Es ermöglicht Ihnen, OCR-Funktionalität zu Ihren .NET-Anwendungen in weniger als 10 Codezeilen hinzuzufügen.

Aspose.OCR für .NET

verarbeitet gescannte Bilder oder sogar Smartphone-Fotos im DJVU-Format und erstellt DJVU-Dokumente mit erkanntem Text. Um es zu Ihrem Projekt hinzuzufügen, müssen Sie nur die Datei Aspose.OCR installieren.

NuGet

Paket in Ihrem Projekt mit dem folgenden Befehl:

Package Manager Console Command


  PM> Install-Package Aspose.OCR

Schritte zum Konvertieren von DJVU in Searchable PDF

Mit .NET OCR und nur wenigen Codezeilen können Sie eine voll funktionsfähige Anwendung erstellen, die ein DJVU-Bild in ein Searchable PDF-Dokument konvertiert:

  • Erstellen Sie eine Instanz der Klasse AsposeOcr
  • Rufen Sie die Methode AsposeOCR.RecognizeImage auf
  • Übergeben Sie den Dateipfad DJVU als Parameter
  • AsposeOCR.RecognizeImage gibt einen String oder eine Datei vom Typ Searchable PDF zurück

System Anforderungen

Stellen Sie vor dem Ausführen des Beispiels sicher, dass die mit der NET Standard 2.0-Spezifikation kompatible .NET-API auf Ihrem System installiert ist und alle [externen Abhängigkeiten]( https://docs.aspose.com/ocr/net/system-requirements/#external- Abhängigkeiten) des Aspose.OCR-Pakets werden in Ihrem Projekt referenziert.

  • NET Standard 2.0+ kompatible Lösung
  • Aspose.OCR für .NET, auf das in Ihrem Projekt verwiesen wird.

Dieser Beispielcode zeigt die Konvertierung von DJVU in Searchable PDF .NET


// initialize an instance of AsposeOcr
AsposeOcr ocr = new AsposeOcr();
// recognize image
string riText = ocr.RecognizeImage("template.DJVU");
// print text
File. File.WriteAllText("document.Searchable PDF", riText);
  • DJVU Was ist DJVU Datei Format

    DjVu, ausgesprochen als „déjà vu“, ist ein Grafikdateiformat, das für gescannte Dokumente und Bücher gedacht ist, insbesondere für solche, die eine Kombination aus Text, Zeichnungen, Bildern und Fotos enthalten. Es wurde von AT&T Labs entwickelt. Es verwendet mehrere Techniken wie Bildebenentrennung von Text und Hintergrundbildern, progressives Laden, arithmetische Codierung und verlustbehaftete Komprimierung für bitonale Bilder. Da die DJVU-Datei komprimierte, aber qualitativ hochwertige Farbbilder, Fotos, Texte und Zeichnungen enthalten kann und daher auf weniger Platz gespeichert werden kann, wird sie im Internet als eBooks, Handbücher, Zeitungen, alte Dokumente usw. verwendet.

    Weiterlesen

    Searchable PDF Was ist Searchable PDF Datei Format

    Durchsuchbare PDF-Dateien behalten das gescannte Originalbild zur Anzeige sowie OCR-Text in einer verborgenen Ebene bei, die für die Volltextsuche in einem Dokument oder zum Hervorheben von Text zum Kopieren und Einfügen verwendet werden kann. Die vollständige OCR-Konvertierung in PDF, ohne das Originalbild, wird niemals 100 % der Originalformatierung beibehalten, insbesondere wenn das Dokument viele Bilder oder ein komplexes Layout enthält.

    Weiterlesen

    Andere unterstützte Konvertierungen

    Mit C# kann man problemlos verschiedene Formate konvertieren, einschließlich.

    TXT (Textdokumentdatei)
    Text (Textdokumentdatei)
    DOC (Von Microsoft Word generierte Dokumente)
    DOCX (Microsoft Word-Dokumente)
    XLS (Binäres Dateiformat von Microsoft Excel)
    XLSX (Microsoft Excel-Dokumente)
    PDF (Portables Dokumentenformat (PDF))
    Searchable PDF (Durchsuchbare tragbare Netzwerkgrafiken)
    XML (Erweiterbare Auszeichnungssprache)
    JSON (JavaScript-Objekt-Notation)