Разбирайте документы, такие как счета-фактуры, чеки или финансовые таблицы, чтобы извлекать текст, изображения и метаданные из более чем 40 популярных форматов документов.
Начать бесплатную пробную версиюGroupDocs.Parser Cloud для Java - это обёртка над извлечением данных из документов REST API, позволяющая разбирать более 50 типов документов. Разбор документов с предопределёнными шаблонами является одной из самых ценных функций GroupDocs.Parser Cloud API. Определять шаблоны и извлекать данные из счетов-фактур или других типичных документов очень просто и удобно. API предоставляет методы для извлечения изображений, текста и метаданных из почти всех распространённых форматов файлов. Помимо обычных документов, вы можете использовать поддерживаемые возможности для файлов, защищённых паролем, и контейнеров, таких как ZIP-архивы, файлы почты OST/PST, электронные книги, разметки и портфолио PDF в ваших приложениях Java.
Посмотрите наш Cloud SDKs для Java по адресу GitHub, если вы ищете исходный код для парсинга файлов в облаке.
Вы можете попробовать GroupDocs.Parser Low-Code Java APIs без каких-либо ограничений.
GroupDocs.Parser Cloud также доступен в виде образа Docker, который можно использовать для самостоятельного размещения сервиса. Или вы можете создать свои собственные сервисы, используя GroupDocs.Parser High-code APIs, которые в настоящее время поддерживают как наши Free Apps, так и REST APIs.
GroupDocs.Parser Cloud API предоставляет несколько способов извлечения изображений из документов. Вы можете извлечь все изображения из всего документа, а также извлечь изображения с конкретных страниц, задав диапазон страниц. Следующий пример показывает, как извлечь изображения из документа внутри контейнера.
// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
String MyAppKey = "";
String MyAppSid = "";
Configuration configuration = new Configuration(MyAppSid, MyAppKey);
ParseApi apiInstance = new ParseApi(configuration);
FileInfo fileInfo = new FileInfo();
fileInfo.setFilePath("pdf/PDF with attachments.pdf");
fileInfo.setPassword("password");
ContainerItemInfo containerItemInfo = new ContainerItemInfo();
containerItemInfo.setRelativePath("template-document.pdf");
ImagesOptions options = new ImagesOptions();
options.setFileInfo(fileInfo);
options.setContainerItemInfo(containerItemInfo);
ImagesRequest request = new ImagesRequest(options);
ImagesResult response = apiInstance.images(request);
// For complete examples and data files, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-java-samples