HTML JPG OCR XML BMP
Aspose.OCR  C++の場合
XLSX

[Aspose.Imaging for Java](https://products.aspose.com/imaging/java) スキャンした画像やスマートフォンの写真をDJVU形式で処理し、認識されたテキストを含むDJVUドキュメントを作成します。プロジェクトに追加するには、Aspose.OCRを取得する必要があります [Maven](https://repository.aspose.com/webapp/#/artifacts/browse/tree/General/repo/com/aspose/aspose-imaging)またはAsposeMavenリポジトリ構成を指定します _pom.xml_に次の構成を追加して、Mavenベースのプロジェクトにインストールします。 Graddle、Ivy、Sbtの例については、[リポジトリ](https://repository.aspose.com/ocr/)を確認してください。

Package Manager Console Command


  PM> Install-Package Aspose.OCR.Cpp

C ++ OCRと数行のコードを使用して、DJVU画像をXLSXドキュメントに変換するフル機能のアプリケーションを作成できます。

+AsposeOcrクラスのインスタンスを作成します

  • AsposeOCR.asposeocr_page()メソッドを呼び出す +DJVUファイルパスをパラメータとして渡します
  • AsposeOCR.asposeocr_pageは、XLSXタイプの文字列またはファイルを返します

システム要求

例を実行する前に、[Microsoft.ML.OnnxRuntime](https://www.nuget.org/packages/Microsoft.ML.OnnxRuntime/)1.7.0以降がプロジェクトに追加されていることを確認してください。 NuGetパッケージマネージャーを介してAspose.OCRをインストールすると、自動的にインストールされます。

-NETStandard2.0+互換ソリューション -プロジェクトで参照されているAspose.OCRfor.NET。


std::string img_path = "../srcSample.png";

// Prepare buffer for result (in symbols, len_byte = len * sizeof(wchar_t))
const size_t len = 4096;

wchar_t bfr[len] = { 0 };

size_t result = aspose::ocr::page(image_path.c_str(), bfr, len);

//Print result
std::wcout << bfr << L"\n";
  • DJVU とは DJVU ファイル形式

    「déjàvu」と発音されるDjVuは、スキャンされたドキュメントや書籍、特にテキスト、図面、画像、写真の組み合わせを含むものを対象としたグラフィックファイル形式です。 AT&T研究所によって開発されました。テキストと背景画像の画像レイヤー分離、プログレッシブローディング、算術符号化、ビットノン画像の不可逆圧縮などの複数の手法を使用します。 DJVUファイルには、圧縮された高品質のカラー画像、写真、テキスト、および図面を含めることができ、より少ないスペースで保存できるため、電子書籍、マニュアル、新聞、古代文書などとしてWebで使用されます。

    続きを読む

    XLSX とは XLSX ファイル形式

    XLSXは、MicrosoftOffice2007のリリースでMicrosoftによって導入されたMicrosoftExcelドキュメントのよく知られた形式です。OOXML標準ECMA-376のパート2で概説されているOpenPackagingConventionに従って編成された構造に基づいて、新しい形式は次のようになります。多数のXMLファイルを含むzipパッケージ。基礎となる構造とファイルは、.xlsxファイルを解凍するだけで調べることができます。

    続きを読む