cURL を使用してドキュメントを解析し、データを抽出します。

PDF と Word、Excel、Web、eBooks、Emails、ZIP アーカイブからファイル形式を解析し、テキスト、画像、メタデータを REST API で抽出します。

  • .NET 用の GroupDocs.Parser Cloud SDK
  • Java向けのGroupDocs.Parser Cloud SDK
  • PHP向けのGroupDocs.Parser Cloud SDK
  • Python向けのGroupDocs.Parser Cloud SDK
  • Ruby向けのGroupDocs.Parser Cloud SDK
  • Node.js向けのGroupDocs.Parser Cloud SDK
無料トライアルを開始

GroupDocs.Parser Cloud(cURL 用)は、ほぼすべての一般的なビジネス文書フォーマットの解析とデータ抽出を可能にします。シンプルな cURL コマンドを使用すれば、文書全体または特定のページ範囲からテキストや画像を抽出できます。REST API は、ZIP などのアーカイブの解析もサポートし、画像、ドキュメント情報、コンテナ項目の詳細を抽出します。

Document Parser REST API の機能

PDF、ワードプロセッシング文書、スプレッドシート、プレゼンテーションを解析

Microsoft Word、Excel、PowerPoint、OpenDocument テンプレートファイルを解析

MS Word、Excel、PowerPoint 用のマクロ有効ドキュメントとテンプレートを解析

文書全体からテキストコンテンツを抽出します

特定のページからテキストと画像を抽出します

抽出モードを設定して、書式付きテキストを抽出します

ZIP アーカイブやメール内のドキュメントからテキストを抽出します

メール、PDF ポートフォリオ、MS Outlook ストレージからドキュメントを取得します

ドキュメントのページ数やその他の情報を取得します

ドキュメントからテキストを抽出します

GroupDocs.Parser Cloud API を使用すると、クラウドストレージに配置されたドキュメントから画像、テキスト、メタデータを迅速に抽出できます。以下のシンプルな cURL コマンドは、ドキュメントからテキストを抽出する方法を示しています。

MS Word ドキュメントを解析してテキストを抽出します - cURL

curl -X POST "https://api.groupdocs.cloud/v1.0/parser/text" \
-H "accept: application/json" \
-H "authorization: Bearer TOKEN-HERE" \
-H "Content-Type: application/json" \
-d "{ \"FileInfo\": { \"FilePath\": \"foldername/document.docx\", }}"

GroupDocs.Parser 無料アプリを使用してドキュメントから画像を抽出する

EMLXXLSDOCEPUBMSGPSTDOTMDOCXXLSXEMLCHMJPEGTIFZIPCSVPPTPPTXODSJP2XMLRTFDOCMPNGRARTIFFPPSPPTMBZ2ONEGZMHTMLODTGIFPPSXXHTMLHTMLXLTMODPJPG

GroupDocs.Parser 無料アプリを使用してドキュメントから画像を抽出する

PDFFB2BMPGIFODPRARODTRTFEMLXDOCTXTXLAMTARXMLTIFJPEGOSTPPTONEJPGMHTMLGZODSDOCXXLTMPOTM

サポートと学習リソース

GroupDocs.Parser Cloud は、以下に示す他の言語向けに個別ドキュメント解析 SDKs も提供しています:

  日本語
5fc1ea462