Разбирайте документы и извлекайте данные с помощью cURL

Разбирайте PDF и форматы файлов из Word, Excel, веб, электронных книг, электронных писем, ZIP-архивов, чтобы извлекать текст, изображения и метаданные с помощью REST API.

  • GroupDocs.Parser Cloud SDK для .NET
  • GroupDocs.Parser Cloud SDK для Java
  • GroupDocs.Parser Cloud SDK для PHP
  • GroupDocs.Parser Cloud SDK для Python
  • GroupDocs.Parser Cloud SDK для Ruby
  • GroupDocs.Parser Cloud SDK для Node.js
Начать бесплатную пробную версию

GroupDocs.Parser Cloud для cURL позволяет разбирать и извлекать данные почти из всех распространённых форматов бизнес-документов. С помощью простых команд cURL можно извлекать текст и изображения как из всего документа, так и из указанного диапазона страниц. REST API также поддерживает разбор архивов, таких как ZIP, и извлечение изображений, информации о документе и деталей элементов контейнера.

Функции парсера документов REST API

Разбор PDF, текстовых документов, электронных таблиц и презентаций

Разбор файлов шаблонов Microsoft Word, Excel, PowerPoint и OpenDocument

Разбор документов и шаблонов с поддержкой макросов для MS Word, Excel и PowerPoint

Извлекать текстовое содержимое из полного документа

Извлекать текст и изображения с определённых страниц

Извлекать отформатированный текст, задав режим извлечения

Извлекать текст из документов в ZIP-архивах или электронных письмах

Получать документы из электронных писем, портфолио PDF и хранилищ MS Outlook

Получать количество страниц документа и другую информацию

Извлекать текст из документа

С помощью GroupDocs.Parser Cloud API вы можете быстро извлекать изображения, текст и метаданные из документа, размещённого в вашем облачном хранилище. Ниже приведена простая команда cURL, показывающая, как извлечь текст из документа.

Разобрать документ MS Word для извлечения текста - cURL

curl -X POST "https://api.groupdocs.cloud/v1.0/parser/text" \
-H "accept: application/json" \
-H "authorization: Bearer TOKEN-HERE" \
-H "Content-Type: application/json" \
-d "{ \"FileInfo\": { \"FilePath\": \"foldername/document.docx\", }}"

Извлечение изображений из документов с помощью бесплатного приложения GroupDocs.Parser

TIFFEMLXDOTMODPRARPPSXPSTZIPXLSXTIFPPTMPNGXMLGZPPTXLTMDOCJPEGMSGGIFCHMPPTXHTMLPPSDOCMMHTMLRTFJP2ONEBZ2ODTCSVODSDOCXEPUBJPGEMLXHTML

Извлечение изображений из документов с помощью бесплатного приложения GroupDocs.Parser

PPTONEJPGXMLGIFXLAMTXTEMLXTARRTFFB2ODSPOTMOSTPDFDOCXXLTMODPGZMHTMLBMPTIFJPEGODTRARDOC

Ресурсы поддержки и обучения

GroupDocs.Parser Cloud также предлагает отдельный разбор документов SDKs для других языков, перечисленных ниже:

  РУССКИЙ
c1167dd9c