HTML JPG OCR XML BMP
Aspose.OCR  C++の場合
XLS

[Aspose.Imaging for Java](https://products.aspose.com/imaging/java) スキャンした画像やスマートフォンの写真をTIF形式で処理し、認識されたテキストを含むTIFドキュメントを作成します。プロジェクトに追加するには、Aspose.OCRを取得する必要があります [Maven](https://repository.aspose.com/webapp/#/artifacts/browse/tree/General/repo/com/aspose/aspose-imaging)またはAsposeMavenリポジトリ構成を指定します _pom.xml_に次の構成を追加して、Mavenベースのプロジェクトにインストールします。 Graddle、Ivy、Sbtの例については、[リポジトリ](https://repository.aspose.com/ocr/)を確認してください。

Package Manager Console Command


  PM> Install-Package Aspose.OCR.Cpp

C ++ OCRと数行のコードを使用して、TIF画像をXLSドキュメントに変換するフル機能のアプリケーションを作成できます。

+AsposeOcrクラスのインスタンスを作成します

  • AsposeOCR.asposeocr_page()メソッドを呼び出す +TIFファイルパスをパラメータとして渡します
  • AsposeOCR.asposeocr_pageは、XLSタイプの文字列またはファイルを返します

システム要求

例を実行する前に、[Microsoft.ML.OnnxRuntime](https://www.nuget.org/packages/Microsoft.ML.OnnxRuntime/)1.7.0以降がプロジェクトに追加されていることを確認してください。 NuGetパッケージマネージャーを介してAspose.OCRをインストールすると、自動的にインストールされます。

-NETStandard2.0+互換ソリューション -プロジェクトで参照されているAspose.OCRfor.NET。


std::string img_path = "../srcSample.png";

// Prepare buffer for result (in symbols, len_byte = len * sizeof(wchar_t))
const size_t len = 4096;

wchar_t bfr[len] = { 0 };

size_t result = aspose::ocr::page(image_path.c_str(), bfr, len);

//Print result
std::wcout << bfr << L"\n";
  • TIF とは TIF ファイル形式

    TIFFまたはTIF(タグ付き画像ファイル形式)は、このファイル形式標準に準拠するさまざまなデバイスでの使用を目的としたラスター画像を表します。いくつかの色空間で、バイレベル、グレースケール、パレットカラー、およびフルカラーの画像データを記述することができます。この形式を使用するアプリケーションのスペースと時間のどちらかを選択するための非可逆圧縮方式と可逆圧縮方式をサポートしています。このフォーマットは拡張可能であり、無制限の量の個人情報または特別目的情報を含めることができるようにいくつかの改訂が行われています。この形式はマシンに依存せず、プロセッサ、オペレーティングシステム、ファイルシステムなどの境界がありません。

    続きを読む

    XLS とは XLS ファイル形式

    XLS拡張子の付いたファイルは、Excelバイナリファイル形式を表します。このようなファイルは、Microsoft Excelだけでなく、OpenOfficeCalcやAppleNumbersなどの他の同様のスプレッドシートプログラムでも作成できます。 Excelによって保存されたファイルは、ワークブックと呼ばれ、各ワークブックに1つ以上のワークシートを含めることができます。データはワークシートに表形式で保存および表示され、数値、テキストデータ、数式、外部データ接続、画像、およびグラフにまたがることができます。 Microsoft Excelなどのアプリケーションを使用すると、ワークブックデータをPDF、CSV、XLSX、TXT、HTML、XPSなどのさまざまな形式にエクスポートできます。 XLSファイル形式は、Microsoft Excel 2007のリリースにより、よりオープンで構造化された形式であるXLSXに置き換えられました。現在、XLSXが最初に使用されていますが、最新バージョンではXLSファイルの作成と読み取りが引き続きサポートされています。

    続きを読む

    TXT (テキストドキュメントファイル)
    Text (テキストドキュメントファイル)
    DOC (MicrosoftWordによって生成されたドキュメント)
    DOCX (MicrosoftWordドキュメント)
    XLS (MicrosoftExcelバイナリファイル形式)
    XLSX (MicrosoftExcelドキュメント)
    PDF (ポータブルドキュメントフォーマット(PDF))
    Searchable PDF (検索可能なポータブルネットワークグラフィックス)