스캔한 이미지나 스마트폰 사진까지 JPEG2000 형식으로 처리하고 인식된 텍스트가 포함된 JPEG2000 문서를 만듭니다. 프로젝트에 추가하려면 Aspose.OCR만 있으면 됩니다.
Maven 또는 Aspose Maven Repository 구성 지정 다음 구성을 _pom.xml_에 추가하여 Maven 기반 프로젝트 내에 설치합니다. Gradle, Ivy, Sbt 예제는 repository 에서 확인하세요.
Maven Dependency
<dependency>
<groupId>com.aspose</groupId>
<artifactId>aspose-ocr</artifactId>
<version>22.5</version>
</dependency>
Java OCR과 몇 줄의 코드만으로 JPEG2000 이미지를 Searchable PDF 문서로 변환하는 완전한 기능의 애플리케이션을 만들 수 있습니다.
- AsposeOcr 클래스의 인스턴스 생성
- AsposeOCR.RecognizePage 메서드 호출
- JPEG2000 파일 경로를 매개변수로 전달
- AsposeOCR.RecognizePage는 Searchable PDF 유형의 문자열 또는 파일을 반환합니다.
시스템 요구 사항
예제를 실행하기 전에 J2SE(Java 2 Platform, Standard Edition) 6.0(1.6) 이상이 시스템에 설치되어 있는지 확인하십시오.
- JDK 1.6 이상이 설치되어 있습니다.
//Create API instance
AsposeOCR api = new AsposeOCR();
//Prepare rectangles with texts.
ArrayList rectArray = new ArrayList();
rectArray.add(new Rectangle(138, 352, 2033, 537));
rectArray.add(new Rectangle(147, 890, 2033, 1157));
String result = api.RecognizePage("srcImage.png", rectArray);
System.out.println("Result with rect: " + result);
JPEG2000 무엇인가요 JPEG2000 파일 형식
JPEG 2000(JP2)은 이미지 코딩 시스템이자 최첨단 이미지 압축 표준입니다. 웨이블릿 기술을 사용하여 설계된 JPEG 2000은 한 번에 모든 품질의 무손실 콘텐츠를 코딩할 수 있습니다. 게다가 JPEG 2000은 코딩 효율성에 있어 실질적인 불이익 없이 동일한 콘텐츠에 액세스하고 다양한 다른 해상도와 품질로 효과적으로 디코딩할 수 있는 기능을 가지고 있습니다. JPEG 2000의 코드 스트림은 공간 랜덤 액세스를 위한 기능을 제공하는 관심 영역을 갖도록 확장할 수 있습니다. 최대 16384개의 다양한 구성 요소를 테라픽셀 단위의 치수와 38비트/샘플의 정밀도까지 보유합니다.
더 읽어보기Searchable PDF 무엇인가요 Searchable PDF 파일 형식
검색 가능한 PDF 파일은 문서 내에서 전체 텍스트 검색에 사용하거나 복사 및 붙여넣기 작업을 위해 텍스트를 강조 표시하는 데 사용할 수 있는 숨겨진 레이어의 OCR 텍스트뿐만 아니라 볼 수 있도록 원본 스캔 이미지를 유지합니다. 원본 이미지를 포함하지 않는 PDF로의 전체 OCR 변환은 특히 문서에 이미지가 많거나 복잡한 레이아웃이 있는 경우 원본 형식을 100% 유지하지 않습니다.
더 읽어보기