[Aspose.Imaging cho Java] ( https://products.aspose.com/imaging/java ) xử lý hình ảnh được quét hoặc thậm chí ảnh điện thoại thông minh ở định dạng WBMP và tạo tài liệu WBMP chứa văn bản được nhận dạng. Để thêm nó vào dự án của bạn, bạn chỉ cần lấy * Aspose.OCR * [Maven] ( https://repository.aspose.com/webapp/#/artifacts/browse/tree/General/repo/com/aspose/aspose-imaging ) hoặc chỉ định cấu hình kho lưu trữ Aspose Maven và cài đặt nó trong dự án dựa trên Maven của bạn bằng cách thêm các cấu hình sau vào pom.xml. Đối với các ví dụ về Graddle, Ivy, Sbt, hãy xem [kho lưu trữ] của chúng tôi ( https://repository.aspose.com/ocr/) .
Maven Dependency
<dependency>
<groupId>com.aspose</groupId>
<artifactId>aspose-ocr</artifactId>
<version>22.5</version>
</dependency>
Với Java OCR và chỉ một vài dòng mã, bạn có thể tạo ứng dụng đầy đủ tính năng để chuyển đổi hình ảnh WBMP thành tài liệu Searchable PDF:
- Tạo một thể hiện của lớp AsposeOcr
- Gọi phương thức AsposeOCR.RecognizePage
- Chuyển đường dẫn tệp WBMP làm tham số
- AsposeOCR.RecognizePage trả về một Chuỗi hoặc tệp thuộc loại Searchable PDF
yêu cầu hệ thống
Trước khi chạy ví dụ này, hãy đảm bảo rằng Java 2 Platform, Standard Edition (J2SE) 6.0 (1.6) trở lên được cài đặt trên hệ thống của bạn.
- Đã cài đặt JDK 1.6 trở lên.
//Create API instance
AsposeOCR api = new AsposeOCR();
//Prepare rectangles with texts.
ArrayList rectArray = new ArrayList();
rectArray.add(new Rectangle(138, 352, 2033, 537));
rectArray.add(new Rectangle(147, 890, 2033, 1157));
String result = api.RecognizePage("srcImage.png", rectArray);
System.out.println("Result with rect: " + result);
WBMP Là gì WBMP Định dạng tệp
WBMP là định dạng tệp đồ họa đơn sắc được tối ưu hóa cho các thiết bị điện toán di động. Ảnh WBMP là ảnh đơn sắc (đen trắng) để kích thước ảnh được giữ ở mức tối thiểu. Một pixel màu đen được ký hiệu là 0 và một pixel màu trắng được ký hiệu là 1.
Đọc thêmSearchable PDF Là gì Searchable PDF Định dạng tệp
Các tệp PDF có thể tìm kiếm giữ lại hình ảnh được quét gốc để xem, cũng như văn bản OCR trong một lớp ẩn có thể được sử dụng để tìm kiếm toàn văn trong tài liệu hoặc đánh dấu văn bản cho các thao tác sao chép và dán. Chuyển đổi OCR đầy đủ sang PDF, không bao gồm hình ảnh gốc, sẽ không bao giờ giữ lại 100% định dạng ban đầu, đặc biệt nếu tài liệu có nhiều hình ảnh hoặc bố cục phức tạp.
Đọc thêm