Eine DOCX-Datei ist ein ZIP-Container, und jedes im Dokument platzierte Bild befindet sich darin als separate PNG-, JPEG- oder EMF-Datei. Das Umbenennen des Dokuments und das manuelle Entpacken funktionieren einmalig, skaliert jedoch nicht für einen Ordner mit Berichten.
GroupDocs.Parser Cloud liest diese Struktur direkt aus und liefert die eingebetteten Bilder zurück: Fotos, Logos, als Bilder eingefügte Diagramme und gescannte Seiten. Die gleiche Anfrage funktioniert ebenfalls für DOC und mehr als 50 weitere Dateiformate, sodass gemischte Archive nur einen Code-Pfad benötigen.
Ab cURL authentifizieren Sie sich mit einer Client-ID und einem Secret, senden den Dateinamen in einem kleinen JSON-Body und lesen die Liste der extrahierten Bilder aus der Antwort. Es wird nichts lokal installiert, sodass der Aufruf in ein Shell-Script oder einen nächtlichen Job passt.
Text- und Dokument-Metadaten stehen über dieselbe API zur Verfügung, wenn ein Projekt sie später benötigt, und der kostenlose Online-Extraktor verarbeitet eine einzelne Word-Datei vollständig ohne Code.
GroupDocs.Parser Cloud ist ein cloud-basiertes Dokument-Parsing- und Datenextraktions-API. Es ermöglicht Entwicklern, Dokumentenverarbeitungs-Funktionen in ihre Anwendungen oder Workflows zu integrieren, ohne dass eine Installation oder Wartung von Software oder Infrastruktur erforderlich ist.
Mit GroupDocs.Parser Cloud können Sie mit verschiedenen Dokumentformaten arbeiten, darunter PDF, Microsoft Word, Excel, PowerPoint und weitere. Der API bietet eine breite Palette an Funktionen, um strukturierte Daten aus Dokumenten zu extrahieren, wie Text, Metadaten, Bilder, Tabellen und sogar Rohdateiinhalte.
GroupDocs.Parser Cloud unterstützt eine breite Palette von Dokumentformaten, darunter DOCX, PDF, Microsoft Word (DOC, DOCX), Excel (XLS, XLSX), PowerPoint (PPT, PPTX) sowie verschiedene Bildformate wie JPEG, PNG, TIFF und mehr.
Ja, GroupDocs.Parser Cloud kann Metadaten aus verschiedenen Dokumentformaten extrahieren, einschließlich DOCX. Metadaten umfassen Informationen wie Dokumenteigenschaften (Autor, Erstellungsdatum usw.), Dokumenttitel, Schlüsselwörter und mehr.
GroupDocs.Parser Cloud ermöglicht es Ihnen, Vorlagen zum Extrahieren strukturierter Daten zu erstellen. Vorlagen können Felddefinitionen, Tabellendesigns und regex-basierte Regeln enthalten, um Daten präzise aus wiederkehrenden Dokumenten wie Rechnungen oder Verträgen zu extrahieren.
Ja, GroupDocs.Parser Cloud enthält OCR und kann Text aus gescannten PDFs- und DOCX-Dokumenten anhand von Bildern extrahieren. Sie können die OCR-Optionen über die API-Einstellungen aktivieren, um gescannte Inhalte in maschinenlesbaren Text zu konvertieren.
GroupDocs.Parser Cloud bietet verschiedene Preispläne, die auf Faktoren wie die API-Nutzung, die Speicheranforderungen und die Support-Optionen basieren. Sehen Sie sich unsere pricing für detaillierte Informationen und Optionen an.
Mit GroupDocs.Parser Cloud können Sie verschiedene Datentypen aus Dokumenten extrahieren, z. B. Text, Metadaten, Bilder, Tabellen und andere strukturierte Informationen. Sie können zudem Textanalysen durchführen, nach bestimmten Schlüsselwörtern oder Mustern suchen und Dokumente in verschiedene Formate konvertieren.
Ja, GroupDocs.Parser Cloud bietet umfassende Dokumentation, die API Referenz, SDK Beispiele, Codebeispiele und Leitfäden enthält, um Ihnen den Einstieg in die Integration und Verwendung von API zu erleichtern.
Senden Sie die DOCX-Datei an GroupDocs.Parser Cloud und fordern Sie die Bildextraktion an. Der Dienst liest das Dokumentpaket auf dem Server und gibt jedes eingebettete Bild zurück, sodass keine Kopie von Microsoft Word und keine Desktop-Software jeglicher Art auf Ihrem Rechner erforderlich ist.
Ja. Der Bildextraktor akzeptiert das ältere binäre DOC-Format neben DOCX sowie mehr als 50 weitere Formate, darunter PDF, Tabellenkalkulationen und Präsentationen. Dieselbe Anfrage deckt alle Formate ab, was einen Batch-Job über einen gemischten Ordner einfach macht.
Mit GroupDocs.Parser Cloud können Sie Bilder aus Dokumenten extrahieren. Diese Funktion ermöglicht es Ihnen, in verschiedenen Dokumentformaten eingebettete Bilder, einschließlich DOCX, abzurufen und verschafft Ihnen Zugriff auf visuelle Inhalte.
GroupDocs.Parser Cloud unterstützt eine breite Palette von Dokumentformaten, darunter PDF, Microsoft Word (DOC, DOCX), Excel (XLS, XLSX), PowerPoint (PPT, PPTX) sowie verschiedene Bildformate wie JPEG, PNG, TIFF und weitere.
GroupDocs.Parser Cloud ermöglicht es Ihnen, Text aus verschiedenen Dokumentformaten zu extrahieren, darunter DOCX PDF, Word-Dokumente, Excel-Tabellen, PowerPoint-Präsentationen und mehr. Sie können Text aus einzelnen Seiten oder dem gesamten Dokument extrahieren.
Der API ermöglicht es Ihnen, Metadaten aus DOCX und anderen Dokumenten zu extrahieren, beispielsweise Dokumenteigenschaften (Autor, Erstellungsdatum usw.), Titel, Schlüsselwörter und weitere relevante im Dokument eingebettete Informationen.
GroupDocs.Parser Cloud bietet fortschrittliche Tabellenerkennungsfunktionen. Es kann Tabellen in Dokumenten erkennen, deren Struktur analysieren und tabellarische Daten zusammen mit zugehörigen Formatierungsinformationen extrahieren.