Convertir JPG en DOCX en C#
Effectuez la reconnaissance optique des caractères sur le document JPG et enregistrez le texte en tant que document JPG à l’aide d’Aspose.OCR de la bibliothèque .NET.
Comment convertir JPG en DOCX en utilisant C#
Aspose.OCR pour .NET est une bibliothèque puissante mais facile à utiliser et rentable pour convertir des images JPG en documents DOCX. Prenant en charge 26 langues basées sur le latin, le cyrillique et le chinois, son moteur de reconnaissance optique de caractères à la pointe de la technologie offre une vitesse et une précision de reconnaissance supérieures, tout en vous isolant des formules, des réseaux de neurones et d’autres détails techniques complexes. Il vous permet d’ajouter la fonctionnalité OCR à vos applications .NET en moins de 10 lignes de code.
traite les images numérisées ou même les photos de smartphone au format JPG et crée des documents JPG contenant du texte reconnu. Pour l’ajouter à votre projet, il vous suffit d’installer le Aspose.OCR
package dans votre projet avec la commande suivante :
Package Manager Console Command
PM> Install-Package Aspose.OCR
Étapes pour convertir JPG en DOCX
Avec .NET OCR et seulement quelques lignes de code, vous pouvez créer une application complète qui convertit une image JPG en document DOCX :
- Créer une instance de la classe AsposeOcr
- Appelez la méthode AsposeOCR.RecognizeImage
- Passez le chemin du fichier JPG en paramètre
- AsposeOCR.RecognizeImage renvoie une chaîne ou un fichier de type DOCX
Configuration requise
Avant d’exécuter l’exemple, assurez-vous que l’API .NET compatible avec la spécification NET Standard 2.0 est installée sur votre système et que toutes les [dépendances externes]( https://docs.aspose.com/ocr/net/system-requirements/#external- dépendances) du package Aspose.OCR sont référencés dans votre projet.
- Solution compatible NET Standard 2.0+
- Aspose.OCR pour .NET référencé dans votre projet.
Cet exemple de code montre la conversion JPG à DOCX .NET
// initialize an instance of AsposeOcr
AsposeOcr ocr = new AsposeOcr();
// recognize image
string riText = ocr.RecognizeImage("template.JPG");
// print text
File. File.WriteAllText("document.DOCX", riText);
JPG Qu'est-ce que JPG Format de fichier
Un JPEG est un type de format d'image enregistré à l'aide de la méthode de compression avec perte. L'image de sortie, résultant de la compression, est un compromis entre la taille de stockage et la qualité de l'image. Les utilisateurs peuvent ajuster le niveau de compression pour atteindre le niveau de qualité souhaité tout en réduisant la taille de stockage. La qualité de l'image est négligeable si une compression 10:1 est appliquée à l'image. Plus la valeur de compression est élevée, plus la dégradation de la qualité de l'image est importante.
Lire la suiteDOCX Qu'est-ce que DOCX Format de fichier
DOCX est un format bien connu pour les documents Microsoft Word. Introduit à partir de 2007 avec la sortie de Microsoft Office 2007, la structure de ce nouveau format de document est passée de binaire brut à une combinaison de fichiers XML et binaires. Les fichiers Docx peuvent être ouverts avec Word 2007 et les versions latérales, mais pas avec les versions antérieures de MS Word qui prennent en charge les extensions de fichier DOC.
Lire la suiteAutres conversions prises en charge
En utilisant C#, on peut facilement convertir différents formats, y compris.