Estrazione dei dati del documento SDK per .NET: Testo, Immagini

GroupDocs.Parser Cloud offre a un progetto .NET un modo per leggere il contenuto di un documento archiviato. Una chiamata specifica il file e il tipo di contenuto desiderato, e la risposta restituisce il testo delle pagine, le immagini incorporate o i campi di metadati registrati sul file.

I modelli gestiscono i documenti che condividono lo stesso layout. Le posizioni dei campi e le aree delle tabelle vengono descritte una sola volta, poi applicate a ogni fattura, ricevuta o modulo di quel tipo, così i valori arrivano come risultati nominati anziché come testo non strutturato che deve ancora essere interpretato.

Sono supportati più di 50 formati, tra cui PDF, Word, Excel, PowerPoint, messaggi email, ebook, archivi e pagine web. L’analisi avviene sul server, quindi non è necessario che sulla macchina che effettua la chiamata sia presente nulla al di fuori del pacchetto SDK.

La distribuzione avviene tramite NuGet, e ogni richiesta include il Client ID dell’account con il relativo Secret. La valutazione si svolge all’interno della prova gratuita. Il codice sorgente SDK e gli esempi eseguibili sono pubblicati su GitHub per gli sviluppatori che preferiscono leggere le chiamate prima di adottarle.

  • GroupDocs.Parser Cloud per cURL
  • GroupDocs.Parser Cloud SDK per Java
  • GroupDocs.Parser Cloud SDK per PHP
  • GroupDocs.Parser Cloud SDK per Python
  • GroupDocs.Parser Cloud SDK per Ruby
  • GroupDocs.Parser Cloud SDK per Node.js
Inizia la prova gratuita

GroupDocs.Parser Cloud SDK facilita gli sviluppatori .NET a analizzare qualsiasi documento per estrarre testo, immagini e metadati all’interno di applicazioni basate su .NET. SDK (REST API Client) è il modo più semplice e veloce per te, sviluppatore, di accelerare lo sviluppo. Questo ti permette di concentrarti solo sulla scrittura del codice specifico del progetto e di non preoccuparti dei dettagli di basso livello relativi all’invio delle richieste e alla gestione delle risposte. I documenti possono essere analizzati tramite template definiti dall’utente, facili da usare, con definizioni di campi dati e di tabelle. Poi è semplice estrarre dati come campi di testo, numeri, tabelle dai documenti tipici e anche da contenitori come archivi ZIP, OST/PST file di dati mail, eBook, markup e portafogli PDF.

Domande frequenti

Voglio creare la mia applicazione .NET in grado di analizzare i file online?

Consulta il nostro Cloud SDKs per .NET su GitHub se stai cercando il codice sorgente per analizzare i file nel Cloud.

Posso provare GroupDocs.Parser REST APIs su .NET gratuitamente?

Puoi provare GroupDocs.Parser Low-Code .NET APIs senza alcuna limitazione.

Cosa può il .NET SDK estrarre da un documento?

Tre tipi di contenuto. Il testo dell’intero file o di una pagina scelta, le immagini memorizzate al suo interno e i metadati registrati, come autore, titolo e data di creazione. Un modello aggiunge campi denominati e valori di tabella a quell’elenco.

Come funziona il parsing basato su modello?

Un modello descrive dove si trovano i valori desiderati nella pagina, in base alla posizione, al testo circostante o all’area della tabella. Eseguendolo su un documento con quel layout, restituisce ogni valore con il nome assegnato, il che è adatto a fatture e altri moduli ricorrenti.

Funzionalità del parser di documenti REST API

Analizza PDF, documenti di videoscrittura, fogli di calcolo e presentazioni

Analizza i file modello Microsoft Word, Excel, PowerPoint e OpenDocument

Analizza documenti e modelli abilitati alle macro per MS Word, Excel e PowerPoint

Estrai il contenuto testuale dall’intero documento

Estrai testo e immagini da pagine specifiche

Estrai testo formattato impostando la modalità di estrazione

Estrai testo dai documenti contenuti in archivi ZIP o email

Recupera documenti da email, portafogli PDF e archivi MS Outlook

Ottieni il conteggio delle pagine del documento e altre informazioni

Estrai il testo da un documento per intervallo di pagine

GroupDocs.Parser Cloud API, offre diversi modi per estrarre il testo dai documenti. Puoi estrarre solo il testo, estrarre il testo formattato impostando le modalità di estrazione, estrarre dalle pagine specifiche impostando l’intervallo di pagine. L’esempio seguente mostra come estrarre il testo da un documento PDF impostando l’intervallo di pagine.

Analizza il documento PDF per estrarre il testo da pagine specifiche - C# .NET

// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
  string MyAppKey = "";
  string MyAppSid = "";

  var configuration = new Configuration(MyAppSid, MyAppKey);

  var apiInstance = new ParseApi(configuration);
  var fileInfo = new FileInfo
  {
  FilePath = "directory/document.pdf"
  };

  var options = new TextOptions
  {
  FileInfo = fileInfo,
  StartPageNumber = 1,
  CountPagesToExtract = 2
  };

  var request = new TextRequest(options);
  var response = apiInstance.Text(request);

  // For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples

Estrai le immagini dai documenti utilizzando l'app gratuita GroupDocs.Parser

Estrai le immagini dai documenti utilizzando l'app gratuita GroupDocs.Parser

Supporto e risorse per l'apprendimento

GroupDocs.Parser Cloud offre anche l’analisi individuale dei documenti SDKs per altre lingue come elencate di seguito:

  Italiano
a1e0b5ce7