40 以上の一般的なドキュメント形式からデータを抽出します。テンプレートを適用してバッチ処理でドキュメントを解析します。
無料トライアルを開始GroupDocs.Parser Cloud for Python は、50 以上の一般的なドキュメントタイプからデータを解析できます。テキスト抽出、画像抽出、テンプレートによるデータ解析は、GroupDocs.Parser の最も価値ある機能であり、当社の Cloud REST API サービスでも利用可能です。SDK を使用すれば、事前に定義されたテンプレートを適用するだけで、多くの文書処理自動化タスクを解決し、データを簡単に抽出できます。通常の文書に加えて、ZIP アーカイブや OST/PST メールデータファイル、eBook、マークアップ、PDF ポートフォリオなど、パスワード保護されたファイルやコンテナにもサポート機能を利用できます。これらはすべて Python アプリケーションで活用できます。
クラウドでファイルを解析するためのソースコードをお探しの場合は、GitHub(https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-python)にあるPython向けのCloud SDKsをご確認ください。
制限なく、Low-Code Python APIs をhttps://purchase.groupdocs.cloud/trialでGroupDocs.Parserできます。
GroupDocs.Parser Cloud API は、テンプレートによってドキュメントからデータを抽出できる機能です。請求書、領収書、レポートなどの典型的なドキュメント用にテンプレートを定義でき、テンプレートを適用することで、データを簡単に抽出し、さらに処理に利用できます。以下の例は、テンプレートでデータを抽出する方法を示しています。
# For complete examples and data files, please go to https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-python-samples
import groupdocs_parser_cloud
app_sid = "XXXX-XXXX-XXXX-XXXX" # Get AppKey and AppSID from https://dashboard.groupdocs.cloud
app_key = "XXXXXXXXXXXXXXXX" # Get AppKey and AppSID from https://dashboard.groupdocs.cloud
parseApi = groupdocs_parser_cloud.ParseApi.from_keys(app_sid, app_key)
options = groupdocs_parser_cloud.ParseOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "words-processing/docx/companies.docx"
options.template_path = "templates/companies.json"
request = groupdocs_parser_cloud.ParseRequest(options)
result = parseApi.parse(request)
```