HTML JPG OCR XML BMP
Aspose.OCR  pour .NET
XML

Convertir TIFF en XML en C#

Effectuez la reconnaissance optique des caractères sur le document TIFF et enregistrez le texte en tant que document TIFF à l’aide d’Aspose.OCR de la bibliothèque .NET.

Comment convertir TIFF en XML en utilisant C#

Aspose.OCR pour .NET est une bibliothèque puissante mais facile à utiliser et rentable pour convertir des images TIFF en documents XML. Prenant en charge 26 langues basées sur le latin, le cyrillique et le chinois, son moteur de reconnaissance optique de caractères à la pointe de la technologie offre une vitesse et une précision de reconnaissance supérieures, tout en vous isolant des formules, des réseaux de neurones et d’autres détails techniques complexes. Il vous permet d’ajouter la fonctionnalité OCR à vos applications .NET en moins de 10 lignes de code.

Aspose.OCR pour .NET

traite les images numérisées ou même les photos de smartphone au format TIFF et crée des documents TIFF contenant du texte reconnu. Pour l’ajouter à votre projet, il vous suffit d’installer le Aspose.OCR

NuGet

package dans votre projet avec la commande suivante :

Package Manager Console Command


  PM> Install-Package Aspose.OCR

Étapes pour convertir TIFF en XML

Avec .NET OCR et seulement quelques lignes de code, vous pouvez créer une application complète qui convertit une image TIFF en document XML :

  • Créer une instance de la classe AsposeOcr
  • Appelez la méthode AsposeOCR.RecognizeImage
  • Passez le chemin du fichier TIFF en paramètre
  • AsposeOCR.RecognizeImage renvoie une chaîne ou un fichier de type XML

Configuration requise

Avant d’exécuter l’exemple, assurez-vous que l’API .NET compatible avec la spécification NET Standard 2.0 est installée sur votre système et que toutes les [dépendances externes]( https://docs.aspose.com/ocr/net/system-requirements/#external- dépendances) du package Aspose.OCR sont référencés dans votre projet.

  • Solution compatible NET Standard 2.0+
  • Aspose.OCR pour .NET référencé dans votre projet.

Cet exemple de code montre la conversion TIFF à XML .NET


// initialize an instance of AsposeOcr
AsposeOcr ocr = new AsposeOcr();
// recognize image
string riText = ocr.RecognizeImage("template.TIFF");
// print text
File. File.WriteAllText("document.XML", riText);
  • TIFF Qu'est-ce que TIFF Format de fichier

    TIFF ou TIF, Tagged Image File Format, représente des images raster destinées à être utilisées sur une variété d'appareils conformes à cette norme de format de fichier. Il est capable de décrire des données d'image à deux niveaux, en niveaux de gris, en couleurs de palette et en couleurs dans plusieurs espaces colorimétriques. Il prend en charge les schémas de compression avec perte et sans perte pour choisir entre l'espace et le temps pour les applications utilisant le format. Le format est extensible et a subi plusieurs révisions qui permettent l'inclusion d'une quantité illimitée d'informations privées ou à usage spécial. Le format ne dépend pas de la machine et est exempt de limites telles que le processeur, le système d'exploitation ou les systèmes de fichiers.

    Lire la suite

    XML Qu'est-ce que XML Format de fichier

    XML signifie Extensible Markup Language qui est similaire à HTML mais différent dans l'utilisation de balises pour définir des objets. L'idée derrière la création du format de fichier XML était de stocker et de transporter des données sans dépendre d'outils logiciels ou matériels. Sa popularité est due au fait qu'il est à la fois lisible par l'homme et par la machine. Cela lui permet de créer des protocoles de données communs sous la forme d'objets à stocker et à partager sur un réseau tel que le World Wide Web (WWW). Le "X" dans XML est pour extensible, ce qui implique que le langage peut être étendu à n'importe quel nombre de symboles selon les besoins de l'utilisateur. C'est pour ces fonctionnalités que de nombreux formats de fichiers standard l'utilisent, tels que Microsoft Open XML, LibreOffice OpenDocument, XHTML et SVG.

    Lire la suite

    Autres conversions prises en charge

    En utilisant C#, on peut facilement convertir différents formats, y compris.

    TXT (Fichier de document texte)
    Text (Fichier de document texte)
    DOC (Documents générés par Microsoft Word)
    DOCX (Document Microsoft Word)
    XLS (Format de fichier binaire Microsoft Excel)
    XLSX (Documents Microsoft Excel)
    PDF (Format de document portable (PDF))
    Searchable PDF (Graphiques réseau portables consultables)
    XML (Langage de balisage extensible)
    JSON (Notation d'objet JavaScript)