Extraire des images d’un PDF en Python
Comment extraire des images d’un PDF à l’aide de la bibliothèque Python for .NET
Comment extraire des images d'un PDF à l'aide de la bibliothèque Python for .NET
Avez-vous besoin d’extraire des images d’un PDF ? La modification programmatique des documents PDF est un élément essentiel des flux de travail numériques modernes. Avec les bibliothèques Python telles que Aspose.PDF, les développeurs peuvent extraire des images d’un PDF. Ces bibliothèques sont des solutions autonomes qui ne s’appuient sur aucun autre logiciel et sont prêtes à être utilisées à des fins commerciales. Ils couvrent tous les besoins possibles des développeurs Python professionnels.
- Extraire le texte d’un PDF
- Extraire des images d’un PDF
- Extraire les polices d’un PDF
- Extraire les données du formulaire
- Extraire le texte des timbres
- Extraire les données du tableau
Pour extraire des images d’un fichier PDF, nous utiliserons l’API Aspose.PDF for .NET qui est une API de manipulation de documents riche en fonctionnalités, puissante et facile à utiliser pour la plateforme python-net. Ouvrez le gestionnaire de packages NuGet, recherchez Aspose.pdf et installez-le. Vous pouvez également utiliser la commande suivante depuis la console du gestionnaire de packages.
Extraire des images d’un PDF en Python
Pour essayer le code dans votre environnement, vous avez besoin de Aspose.PDF pour Python.
- Chargez le PDF avec une instance de Document.
- Créez un objet XImage pour extraire des images.
- Enregistrez l’image de sortie dans un fichier JPEG.
- Enregistrez le fichier PDF mis à jour.
Extraire des images d'un PDF - Python
Cet exemple de code montre comment extraire des images de documents PDF
Input file:
File not added
Output format:
Output file: