HTML JPG OCR XML BMP
Aspose.OCR  für .NET
XML

Konvertieren Sie JPEG in XML in C#

Führen Sie eine optische Zeichenerkennung für das JPEG-Dokument durch und speichern Sie Text als JPEG-Dokument mit Aspose.OCR aus der .NET-Bibliothek.

So konvertieren Sie JPEG in XML mit C#

Aspose.OCR für .NET ist eine leistungsstarke, aber benutzerfreundliche und kostengünstige Bibliothek zum Konvertieren von JPEG-Bildern in XML-Dokumente. Die hochmoderne optische Zeichenerkennungs-Engine unterstützt 26 Sprachen basierend auf Latein, Kyrillisch und Chinesisch und bietet eine überlegene Erkennungsgeschwindigkeit und -genauigkeit, während Sie von Formeln, neuronalen Netzwerken und anderen komplexen technischen Details isoliert werden. Es ermöglicht Ihnen, OCR-Funktionalität zu Ihren .NET-Anwendungen in weniger als 10 Codezeilen hinzuzufügen.

Aspose.OCR für .NET

verarbeitet gescannte Bilder oder sogar Smartphone-Fotos im JPEG-Format und erstellt JPEG-Dokumente mit erkanntem Text. Um es zu Ihrem Projekt hinzuzufügen, müssen Sie nur die Datei Aspose.OCR installieren.

NuGet

Paket in Ihrem Projekt mit dem folgenden Befehl:

Package Manager Console Command


  PM> Install-Package Aspose.OCR

Schritte zum Konvertieren von JPEG in XML

Mit .NET OCR und nur wenigen Codezeilen können Sie eine voll funktionsfähige Anwendung erstellen, die ein JPEG-Bild in ein XML-Dokument konvertiert:

  • Erstellen Sie eine Instanz der Klasse AsposeOcr
  • Rufen Sie die Methode AsposeOCR.RecognizeImage auf
  • Übergeben Sie den Dateipfad JPEG als Parameter
  • AsposeOCR.RecognizeImage gibt einen String oder eine Datei vom Typ XML zurück

System Anforderungen

Stellen Sie vor dem Ausführen des Beispiels sicher, dass die mit der NET Standard 2.0-Spezifikation kompatible .NET-API auf Ihrem System installiert ist und alle [externen Abhängigkeiten]( https://docs.aspose.com/ocr/net/system-requirements/#external- Abhängigkeiten) des Aspose.OCR-Pakets werden in Ihrem Projekt referenziert.

  • NET Standard 2.0+ kompatible Lösung
  • Aspose.OCR für .NET, auf das in Ihrem Projekt verwiesen wird.

Dieser Beispielcode zeigt die Konvertierung von JPEG in XML .NET


// initialize an instance of AsposeOcr
AsposeOcr ocr = new AsposeOcr();
// recognize image
string riText = ocr.RecognizeImage("template.JPEG");
// print text
File. File.WriteAllText("document.XML", riText);
  • JPEG Was ist JPEG Datei Format

    Ein JPEG ist ein Bildformat, das mit der Methode der verlustbehafteten Komprimierung gespeichert wird. Das Ausgabebild ist als Ergebnis der Komprimierung ein Kompromiss zwischen Speichergröße und Bildqualität. Benutzer können die Komprimierungsstufe anpassen, um die gewünschte Qualitätsstufe zu erreichen, während gleichzeitig die Speichergröße reduziert wird. Die Bildqualität wird vernachlässigbar beeinträchtigt, wenn eine 10:1-Komprimierung auf das Bild angewendet wird. Je höher der Komprimierungswert, desto stärker die Verschlechterung der Bildqualität.

    Weiterlesen

    XML Was ist XML Datei Format

    XML steht für Extensible Markup Language, die HTML ähnlich ist, sich jedoch in der Verwendung von Tags zum Definieren von Objekten unterscheidet. Die Grundidee hinter der Erstellung des XML-Dateiformats bestand darin, Daten zu speichern und zu transportieren, ohne von Software- oder Hardware-Tools abhängig zu sein. Seine Popularität ist darauf zurückzuführen, dass es sowohl von Menschen als auch von Maschinen lesbar ist. Dies ermöglicht es ihm, gemeinsame Datenprotokolle in Form von Objekten zu erstellen, die gespeichert und über ein Netzwerk wie das World Wide Web (WWW) geteilt werden. Das „X“ in XML steht für erweiterbar, was bedeutet, dass die Sprache gemäß den Benutzeranforderungen auf eine beliebige Anzahl von Symbolen erweitert werden kann. Für diese Funktionen nutzen viele Standarddateiformate wie Microsoft Open XML, LibreOffice OpenDocument, XHTML und SVG.

    Weiterlesen

    Andere unterstützte Konvertierungen

    Mit C# kann man problemlos verschiedene Formate konvertieren, einschließlich.

    TXT (Textdokumentdatei)
    Text (Textdokumentdatei)
    DOC (Von Microsoft Word generierte Dokumente)
    DOCX (Microsoft Word-Dokumente)
    XLS (Binäres Dateiformat von Microsoft Excel)
    XLSX (Microsoft Excel-Dokumente)
    PDF (Portables Dokumentenformat (PDF))
    Searchable PDF (Durchsuchbare tragbare Netzwerkgrafiken)
    XML (Erweiterbare Auszeichnungssprache)
    JSON (JavaScript-Objekt-Notation)