HTML JPG OCR XML BMP
Aspose.OCR  Java용
Searchable PDF

자바용 Aspose.Imaging

스캔한 이미지나 스마트폰 사진까지 JP2 형식으로 처리하고 인식된 텍스트가 포함된 JP2 문서를 만듭니다. 프로젝트에 추가하려면 Aspose.OCR만 있으면 됩니다.

Maven 또는 Aspose Maven Repository 구성 지정 다음 구성을 _pom.xml_에 추가하여 Maven 기반 프로젝트 내에 설치합니다. Gradle, Ivy, Sbt 예제는 repository 에서 확인하세요.

Maven Dependency


 <dependency>
 <groupId>com.aspose</groupId>
 <artifactId>aspose-ocr</artifactId>
 <version>22.5</version>
 </dependency>

Java OCR과 몇 줄의 코드만으로 JP2 이미지를 Searchable PDF 문서로 변환하는 완전한 기능의 애플리케이션을 만들 수 있습니다.

  • AsposeOcr 클래스의 인스턴스 생성
  • AsposeOCR.RecognizePage 메서드 호출
  • JP2 파일 경로를 매개변수로 전달
  • AsposeOCR.RecognizePage는 Searchable PDF 유형의 문자열 또는 파일을 반환합니다.

시스템 요구 사항

예제를 실행하기 전에 J2SE(Java 2 Platform, Standard Edition) 6.0(1.6) 이상이 시스템에 설치되어 있는지 확인하십시오.

  • JDK 1.6 이상이 설치되어 있습니다.


 //Create API instance
 AsposeOCR api = new AsposeOCR();

 //Prepare rectangles with texts.
 ArrayList rectArray = new ArrayList();

 rectArray.add(new Rectangle(138, 352, 2033, 537));
 rectArray.add(new Rectangle(147, 890, 2033, 1157));

 String result = api.RecognizePage("srcImage.png", rectArray);
 System.out.println("Result with rect: " + result);
  • JP2 무엇인가요 JP2 파일 형식

    JPEG 2000(JP2)은 이미지 코딩 시스템이자 최첨단 이미지 압축 표준입니다. 웨이블릿 기술을 사용하여 설계된 JPEG 2000은 한 번에 모든 품질의 무손실 콘텐츠를 코딩할 수 있습니다. 게다가 JPEG 2000은 코딩 효율성에 있어 실질적인 불이익 없이 동일한 콘텐츠에 액세스하고 다양한 다른 해상도와 품질로 효과적으로 디코딩할 수 있는 기능을 가지고 있습니다. JPEG 2000의 코드 스트림은 공간 랜덤 액세스를 위한 기능을 제공하는 관심 영역을 갖도록 확장할 수 있습니다. 최대 16384개의 다양한 구성 요소를 테라픽셀 단위의 치수와 38비트/샘플의 정밀도까지 보유합니다.

    더 읽어보기

    Searchable PDF 무엇인가요 Searchable PDF 파일 형식

    검색 가능한 PDF 파일은 문서 내에서 전체 텍스트 검색에 사용하거나 복사 및 붙여넣기 작업을 위해 텍스트를 강조 표시하는 데 사용할 수 있는 숨겨진 레이어의 OCR 텍스트뿐만 아니라 볼 수 있도록 원본 스캔 이미지를 유지합니다. 원본 이미지를 포함하지 않는 PDF로의 전체 OCR 변환은 특히 문서에 이미지가 많거나 복잡한 레이아웃이 있는 경우 원본 형식을 100% 유지하지 않습니다.

    더 읽어보기

    TXT (텍스트 문서 파일)
    Text (텍스트 문서 파일)
    DOC (Microsoft Word에서 생성한 문서)
    DOCX (마이크로소프트 워드 문서)
    XLS (Microsoft Excel 이진 파일 형식)
    XLSX (마이크로소프트 엑셀 문서)
    PDF (휴대용 문서 형식(PDF))
    Searchable PDF (검색 가능한 휴대용 네트워크 그래픽)
    XML (확장 가능한 마크업 언어)
    JSON (자바스크립트 객체 표기법)