HTML JPG OCR XML BMP
Aspose.OCR  .NETの場合
XML

C#でJP2をXMLに変換します

JP2ドキュメントで光学式文字認識を実行し、.NETライブラリのAspose.OCRを使用してテキストをJP2ドキュメントとして保存します。

C#を使用してJP2をXMLに変換する方法

Aspose.OCR for .NETは、JP2画像をXMLドキュメントに変換するための、強力でありながら使いやすく、費用対効果の高いライブラリです。ラテン語、キリル文字、中国語に基づく26の言語をサポートする、最先端の光学式文字認識エンジンは、数式、ニューラルネットワーク、その他の複雑な技術的詳細からユーザーを隔離しながら、優れた認識速度と精度を提供します。これにより、10行未満のコードで.NETアプリケーションにOCR機能を追加できます。

[Aspose.OCR for .NET](https://products.aspose.com/ocr/net) スキャンした画像やスマートフォンの写真をJP2形式で処理し、認識されたテキストを含むJP2ドキュメントを作成します。プロジェクトに追加するには、Aspose.OCRをインストールするだけです。 [NuGet](https://www.nuget.org/packages/aspose.ocr) 次のコマンドを使用してプロジェクトにパッケージ化します。

Package Manager Console Command


  PM> Install-Package Aspose.OCR

JP2をXMLに変換する手順

.NET OCRと数行のコードを使用して、JP2画像をXMLドキュメントに変換するフル機能のアプリケーションを作成できます。

+AsposeOcrクラスのインスタンスを作成します +AsposeOCR.RecognizeImageメソッドを呼び出します +JP2ファイルパスをパラメータとして渡します

  • AsposeOCR.RecognizeImageは、XMLタイプの文字列またはファイルを返します

システム要求

例を実行する前に、NET Standard2.0仕様と互換性のある.NETAPIがシステムとすべての[外部依存関係](https://docs.aspose.com/ocr/net/system-requirements/#external-)にインストールされていることを確認してください。 Aspose.OCRパッケージの依存関係)がプロジェクトで参照されます。

-NETStandard2.0+互換ソリューション -プロジェクトで参照されているAspose.OCRfor.NET。

このサンプルコードは、JP2からXML.NETへの変換を示しています


// initialize an instance of AsposeOcr
AsposeOcr ocr = new AsposeOcr();
// recognize image
string riText = ocr.RecognizeImage("template.JP2");
// print text
File. File.WriteAllText("document.XML", riText);
  • JP2 とは JP2 ファイル形式

    JPEG 2000(JP2)は、画像コーディングシステムであり、最先端の画像圧縮規格です。ウェーブレットテクノロジーを使用して設計されたJPEG2000は、ロスレスコンテンツを任意の品質で一度にコーディングできます。さらに、コーディング効率に実質的なペナルティを課すことなく、JPEG 2000には、同じコンテンツに効果的にアクセスしてデコードし、他のさまざまな解像度や品質に変換する機能があります。 JPEG 2000のコードストリームは非常にスケーラブルであり、空間ランダムアクセスの機能を提供する関心領域があります。テラピクセル単位の寸法と38ビット/サンプルの高精度を備えた最大16384の多様なコンポーネントを備えています。

    続きを読む

    XML とは XML ファイル形式

    XMLはExtensibleMarkupLanguageの略で、HTMLに似ていますが、オブジェクトを定義するためのタグの使用が異なります。 XMLファイル形式の作成の背後にある全体的な考え方は、ソフトウェアやハードウェアのツールに依存することなくデータを保存および転送することでした。その人気は、人間と機械の両方で読み取り可能であるためです。これにより、World Wide Web(WWW)などのネットワークを介して保存および共有されるオブジェクトの形式で共通のデータプロトコルを作成できます。 XMLの「X」は拡張可能であり、ユーザーの要件に応じて言語を任意の数の記号に拡張できることを意味します。 Microsoft Open XML、LibreOffice OpenDocument、XHTML、SVGなど、多くの標準ファイル形式で使用されるのはこれらの機能のためです。

    続きを読む

    その他のサポートされている変換

    C#を使用すると、を含むさまざまな形式を簡単に変換できます。

    TXT (テキストドキュメントファイル)
    Text (テキストドキュメントファイル)
    DOC (MicrosoftWordによって生成されたドキュメント)
    DOCX (MicrosoftWordドキュメント)
    XLS (MicrosoftExcelバイナリファイル形式)
    XLSX (MicrosoftExcelドキュメント)
    PDF (ポータブルドキュメントフォーマット(PDF))
    Searchable PDF (検索可能なポータブルネットワークグラフィックス)
    XML (拡張マークアップ言語)
    JSON (JavaScriptオブジェクト表記)