procesa imágenes escaneadas o incluso fotos de teléfonos inteligentes en formato DJVU y crea documentos DJVU que contienen texto reconocido. Para agregarlo a su proyecto, solo necesita obtener Aspose.OCR
Maven o especifique la configuración del Repositorio Aspose Maven e instálelo dentro de su proyecto basado en Maven agregando las siguientes configuraciones a pom.xml. Para ver ejemplos de Graddle, Ivy, Sbt, consulte nuestro [repositorio] ( https://repository.aspose.com/ocr/ ) .
Package Manager Console Command
PM> Install-Package Aspose.OCR.Cpp
Con C++ OCR y solo unas pocas líneas de código, puede crear una aplicación con todas las funciones que convierte una imagen DJVU en un documento Searchable PDF:
- Crear una instancia de la clase AsposeOcr
- Llamar al método AsposeOCR.asposeocr_page()
- Pase la ruta del archivo DJVU como parámetro
- AsposeOCR.asposeocr_page devuelve una cadena o archivo de tipo Searchable PDF
Requisitos del sistema
Antes de ejecutar el ejemplo, asegúrese de que Microsoft.ML.OnnxRuntime 1.7.0 o superior se agregue al proyecto. Debería instalarse automáticamente si instala Aspose.OCR a través de NuGet Package Manager.
- Solución compatible con NET Standard 2.0+
- Aspose.OCR para .NET referenciado en su proyecto.
std::string img_path = "../srcSample.png";
// Prepare buffer for result (in symbols, len_byte = len * sizeof(wchar_t))
const size_t len = 4096;
wchar_t bfr[len] = { 0 };
size_t result = aspose::ocr::page(image_path.c_str(), bfr, len);
//Print result
std::wcout << bfr << L"\n";
DJVU Que es DJVU Formato de archivo
DjVu, pronunciado como "déjà vu", es un formato de archivo de gráficos destinado a documentos escaneados y libros, especialmente aquellos que contienen una combinación de texto, dibujos, imágenes y fotografías. Fue desarrollado por AT&T Labs. Utiliza múltiples técnicas como la separación de capas de imágenes de texto e imágenes de fondo, carga progresiva, codificación aritmética y compresión con pérdida para imágenes bitonales. Dado que el archivo DJVU puede contener imágenes en color, fotografías, texto y dibujos comprimidos pero de alta calidad y se puede guardar en menos espacio, por lo tanto, se usa en la web como libros electrónicos, manuales, periódicos, documentos antiguos, etc.
Lee masSearchable PDF Que es Searchable PDF Formato de archivo
Los archivos PDF que admiten búsquedas conservan la imagen escaneada original para su visualización, así como el texto OCR en una capa oculta que se puede utilizar para búsquedas de texto completo dentro de un documento o para resaltar texto para operaciones de copiar y pegar. La conversión completa de OCR a PDF, sin incluir la imagen original, nunca conservará el 100 % del formato original, especialmente si el documento tiene muchas imágenes o un diseño complejo.
Lee mas