HTML JPG OCR XML BMP
Aspose.OCR  C++の場合
DOC

[Aspose.Imaging for Java](https://products.aspose.com/imaging/java) スキャンした画像やスマートフォンの写真をJPEG2000形式で処理し、認識されたテキストを含むJPEG2000ドキュメントを作成します。プロジェクトに追加するには、Aspose.OCRを取得する必要があります [Maven](https://repository.aspose.com/webapp/#/artifacts/browse/tree/General/repo/com/aspose/aspose-imaging)またはAsposeMavenリポジトリ構成を指定します _pom.xml_に次の構成を追加して、Mavenベースのプロジェクトにインストールします。 Graddle、Ivy、Sbtの例については、[リポジトリ](https://repository.aspose.com/ocr/)を確認してください。

Package Manager Console Command


  PM> Install-Package Aspose.OCR.Cpp

C ++ OCRと数行のコードを使用して、JPEG2000画像をDOCドキュメントに変換するフル機能のアプリケーションを作成できます。

+AsposeOcrクラスのインスタンスを作成します

  • AsposeOCR.asposeocr_page()メソッドを呼び出す +JPEG2000ファイルパスをパラメータとして渡します
  • AsposeOCR.asposeocr_pageは、DOCタイプの文字列またはファイルを返します

システム要求

例を実行する前に、[Microsoft.ML.OnnxRuntime](https://www.nuget.org/packages/Microsoft.ML.OnnxRuntime/)1.7.0以降がプロジェクトに追加されていることを確認してください。 NuGetパッケージマネージャーを介してAspose.OCRをインストールすると、自動的にインストールされます。

-NETStandard2.0+互換ソリューション -プロジェクトで参照されているAspose.OCRfor.NET。


std::string img_path = "../srcSample.png";

// Prepare buffer for result (in symbols, len_byte = len * sizeof(wchar_t))
const size_t len = 4096;

wchar_t bfr[len] = { 0 };

size_t result = aspose::ocr::page(image_path.c_str(), bfr, len);

//Print result
std::wcout << bfr << L"\n";
  • JPEG2000 とは JPEG2000 ファイル形式

    JPEG 2000(JP2)は、画像コーディングシステムであり、最先端の画像圧縮規格です。ウェーブレットテクノロジーを使用して設計されたJPEG2000は、ロスレスコンテンツを任意の品質で一度にコーディングできます。さらに、コーディング効率に実質的なペナルティを課すことなく、JPEG 2000には、同じコンテンツに効果的にアクセスしてデコードし、他のさまざまな解像度や品質に変換する機能があります。 JPEG 2000のコードストリームは非常にスケーラブルであり、空間ランダムアクセスの機能を提供する関心領域があります。テラピクセル単位の寸法と38ビット/サンプルの高精度を備えた最大16384の多様なコンポーネントを備えています。

    続きを読む

    DOC とは DOC ファイル形式

    拡張子が.docのファイルは、MicrosoftWordまたはその他のワードプロセッシングドキュメントによって生成されたドキュメントをバイナリファイル形式で表します。この拡張機能は、当初、いくつかの異なるオペレーティングシステムでプレーンテキストのドキュメントに使用されていました。画像、プレーンテキスト、グラフ、チャート、埋め込みオブジェクト、リンク、ページ、ページの書式設定、印刷設定など、さまざまな種類のデータを含めることができます。このフォーマットは、マニュアル、提案、仕様、履歴書、記事、または同様のドキュメントを作成するためのさまざまなオプションがユーザーに提供されるため、あらゆる種類のドキュメントで人気がありました。 DOCの更新バージョンはDOCXであり、仕様が公開されているOfficeOpenXMLに基づいています。

    続きを読む

    TXT (テキストドキュメントファイル)
    Text (テキストドキュメントファイル)
    DOC (MicrosoftWordによって生成されたドキュメント)
    DOCX (MicrosoftWordドキュメント)
    XLS (MicrosoftExcelバイナリファイル形式)
    XLSX (MicrosoftExcelドキュメント)
    PDF (ポータブルドキュメントフォーマット(PDF))
    Searchable PDF (検索可能なポータブルネットワークグラフィックス)