Un file DOCX è un contenitore ZIP, e ogni immagine inserita nel documento si trova al suo interno come file separato PNG, JPEG o EMF. Rinominare il documento e decomprimerlo manualmente funziona una volta, ma non è scalabile a una cartella di report.
GroupDocs.Parser Cloud legge direttamente quella struttura e restituisce le immagini incorporate: fotografie, loghi, grafici incollati come immagini e pagine scansionate. La stessa richiesta funziona anche su DOC e su più di 50 altri formati di file, quindi gli archivi misti richiedono un unico percorso di codice.
Da cURL ti autentichi con un Client ID e Secret, invii il nome del file in un piccolo corpo JSON, e leggi l’elenco delle immagini estratte dalla risposta. Non viene installato nulla localmente, quindi la chiamata si adatta a uno script shell o a un job notturno.
Testo e metadati del documento sono disponibili tramite lo stesso API quando un progetto ne ha bisogno in seguito, e l’estrattore online gratuito copre un singolo file Word senza alcun codice.
GroupDocs.Parser Cloud è un API di parsing di documenti e estrazione dati basato su cloud. Consente agli sviluppatori di integrare le capacità di elaborazione dei documenti nelle loro applicazioni o nei flussi di lavoro senza la necessità di installare o mantenere alcun software o infrastruttura.
Con GroupDocs.Parser Cloud, puoi lavorare con vari formati di documento, tra cui PDF, Microsoft Word, Excel, PowerPoint e altri. Il API offre un’ampia gamma di funzionalità per estrarre dati strutturati dai documenti, come testo, metadati, immagini, tabelle e persino il contenuto grezzo dei file.
GroupDocs.Parser Cloud supporta un’ampia gamma di formati di documento, tra cui DOCX, PDF, Microsoft Word (DOC, DOCX), Excel (XLS, XLSX), PowerPoint (PPT, PPTX), e vari formati immagine come JPEG, PNG, TIFF e altri.
Sì, GroupDocs.Parser Cloud può estrarre i metadati da vari formati di documento, inclusi DOCX. I metadati includono informazioni come le proprietà del documento (autore, data di creazione, ecc.), il titolo del documento, le parole chiave e altro ancora.
GroupDocs.Parser Cloud consente di creare modelli per estrarre dati strutturati. I modelli possono contenere definizioni di campo, progetti di tabelle e regole basate su regex per estrarre dati con precisione da documenti ricorrenti, come fatture o contratti.
Sì, GroupDocs.Parser Cloud include OCR e può estrarre testo da documenti PDFs e DOCX scansionati basati su immagini. Puoi abilitare le opzioni OCR tramite le impostazioni API per convertire il contenuto scansionato in testo leggibile da macchine.
GroupDocs.Parser Cloud offre diversi piani tariffari basati su fattori come l’utilizzo di API, i requisiti di archiviazione e le opzioni di supporto. Consulta la nostra sezione pricing per dettagli e opzioni specifiche.
Con GroupDocs.Parser Cloud, puoi estrarre diversi tipi di dati dai documenti, come testo, metadati, immagini, tabelle e altre informazioni strutturate. Puoi anche eseguire analisi del testo, cercare parole chiave o pattern specifici e convertire i documenti in diversi formati.
Sì, GroupDocs.Parser Cloud fornisce una documentazione completa documentazione che include API riferimento, SDK esempi, esempi di codice, e guide per aiutarti a iniziare con l’integrazione e l’uso efficace di API.
Invia il file DOCX a GroupDocs.Parser Cloud e richiedi l’estrazione delle immagini. Il servizio legge il pacchetto del documento sul server e restituisce tutte le immagini incorporate, quindi non è necessaria alcuna copia di Microsoft Word né alcun software desktop sulla tua macchina.
Sì. L’estrattore di immagini accetta il vecchio formato binario DOC insieme a DOCX e più di 50 altri formati, tra cui PDF, fogli di calcolo e presentazioni. La stessa richiesta li gestisce tutti, semplificando l’esecuzione di un batch job su una cartella mista.
Con GroupDocs.Parser Cloud puoi estrarre le immagini dai documenti. Questa funzionalità ti consente di recuperare le immagini incorporate in diversi formati di documento, inclusi DOCX, offrendoti l’accesso ai contenuti visivi.
GroupDocs.Parser Cloud supporta un’ampia gamma di formati di documento, inclusi PDF, Microsoft Word (DOC, DOCX), Excel (XLS, XLSX), PowerPoint (PPT, PPTX), e vari formati immagine come JPEG, PNG, TIFF e altri.
GroupDocs.Parser Cloud ti consente di estrarre il testo da vari formati di documento, tra cui DOCX PDF, documenti Word, fogli di calcolo Excel, presentazioni PowerPoint e altro ancora. Puoi estrarre il testo da pagine singole o dall’intero documento.
Il API ti consente di estrarre i metadati da DOCX e altri documenti, come le proprietà del documento (autore, data di creazione, ecc.), titolo, parole chiave e altre informazioni rilevanti incorporate nel documento.
GroupDocs.Parser Cloud offre funzionalità avanzate di estrazione di tabelle. Può rilevare le tabelle nei documenti, analizzarne la struttura e estrarre i dati tabulari insieme alle informazioni di formattazione associate.