Dokumentdatenextraktion SDK für .NET: Text, Bilder

GroupDocs.Parser Cloud bietet einem .NET-Projekt eine Möglichkeit, den Inhalt eines gespeicherten Dokuments zu lesen. Ein Aufruf gibt den Dateinamen und die gewünschte Inhaltsart an, und die Antwort liefert den Text der Seiten, die darin eingebetteten Bilder oder die Metadatenfelder, die der Datei zugeordnet sind.

Vorlagen verarbeiten Dokumente mit einheitlichem Layout. Feldpositionen und Tabellenbereiche werden einmal definiert und anschließend auf jede Rechnung, Quittung oder jedes Formular dieser Art angewendet, sodass die Werte als benannte Ergebnisse zurückgeliefert werden statt als unstrukturierter Text, der noch interpretiert werden muss.

Mehr als 50 Formate werden unterstützt, darunter PDF, Word, Excel, PowerPoint, E-Mail-Nachrichten, E-Books, Archive und Webseiten. Das Parsen erfolgt auf dem Server, sodass auf dem aufrufenden Rechner nichts weiter als das SDK-Paket vorhanden sein muss.

Die Bereitstellung erfolgt über NuGet, und jede Anfrage enthält die Client-ID des Kontos samt Secret. Die Evaluierung läuft im Rahmen der kostenlosen Testphase. Der SDK-Quellcode und ausführbare Beispiele werden auf GitHub veröffentlicht für Entwickler, die die Aufrufe vor der Integration einsehen möchten.

  • GroupDocs.Parser Cloud für cURL
  • GroupDocs.Parser Cloud SDK für Java
  • GroupDocs.Parser Cloud SDK für PHP
  • GroupDocs.Parser Cloud SDK für Python
  • GroupDocs.Parser Cloud SDK für Ruby
  • GroupDocs.Parser Cloud SDK für Node.js
Kostenlos testen

GroupDocs.Parser Cloud SDK erleichtert .NET Entwicklern das Parsen beliebiger Dokumente, um Text, Bilder und Metadaten innerhalb .NET-basierter Anwendungen zu extrahieren. SDK (REST API Client) ist der einfachste und schnellste Weg für Sie als Entwickler, die Entwicklung zu beschleunigen. So können Sie sich darauf konzentrieren, nur den projektspezifischen Code zu schreiben und müssen sich nicht um die Low-Level-Details von Anfragen und der Verarbeitung der Antworten kümmern. Dokumente können mit einfach zu nutzenden, benutzerdefinierten Vorlagen, die Felddefinitionen und Tabellendefinitionen enthalten, geparst werden. Anschließend ist es einfach, Daten wie Textfelder, Zahlen, Tabellen aus den üblichen Dokumenten und sogar aus Containern wie ZIP-Archiven, OST/PST Mail-Datendateien, eBooks, Markups und PDF Portfolios zu extrahieren.

Häufig gestellte Fragen

Ich möchte meine eigene .NET-Anwendung erstellen, die Dateien online verarbeiten kann?

Sehen Sie sich unser Cloud SDKs für .NET unter GitHub an, wenn Sie den Quellcode zum Parsen von Dateien in der Cloud suchen.

Kann ich GroupDocs.Parser REST APIs auf .NET kostenlos testen?

Sie können GroupDocs.Parser(https://purchase.groupdocs.cloud/trial) Low-Code .NET APIs ohne Einschränkungen ausprobieren.

Was kann der .NET SDK aus einem Dokument extrahieren?

Drei Arten von Inhalten: Der Text der gesamten Datei oder einer ausgewählten Seite, die darin gespeicherten Bilder und die Metadaten, die ihr zugeordnet sind, wie Autor, Titel und Erstellungsdatum. Ein Template fügt dieser Liste benannte Felder und Tabellenwerte hinzu.

Wie funktioniert die templatebasierte Analyse?

Ein Template beschreibt, wo die gewünschten Werte auf der Seite liegen - nach Position, nach umgebendem Text oder nach Tabellenbereich. Wird es auf ein Dokument mit diesem Layout angewendet, liefert es jeden Wert unter dem dafür vergebenen Namen zurück, was für Rechnungen und andere wiederkehrende Formulare geeignet ist.

Funktionen von Document Parser REST API

Parsen Sie PDF, Textverarbeitungsdokumente, Tabellenkalkulationen und Präsentationen

Parsen Sie Microsoft Word, Excel, PowerPoint und OpenDocument Vorlagendateien

Parsen Sie Makro-aktivierte Dokumente und Vorlagen für MS Word, Excel und PowerPoint

Extrahieren Sie den Textinhalt aus dem gesamten Dokument

Extrahieren Sie Text und Bilder aus bestimmten Seiten

Extrahieren Sie formatierten Text, indem Sie den Extraktionsmodus festlegen

Extrahieren Sie Text aus den Dokumenten in ZIP-Archiven oder E-Mails

Rufen Sie Dokumente aus E-Mails, PDF-Portfolios und MS Outlook-Speicher ab

Ermitteln Sie die Seitenzahl des Dokuments und weitere Informationen

Text aus einem Dokument anhand eines Seitenzahlenbereichs extrahieren

GroupDocs.Parser Cloud API, bietet mehrere Möglichkeiten, Text aus den Dokumenten zu extrahieren. Sie können nur Text extrahieren, den formatierten Text extrahieren, indem Sie Extraktionsmodi festlegen, und Text aus bestimmten Seiten extrahieren, indem Sie einen Seitenbereich festlegen. Das folgende Beispiel zeigt, wie Sie Text aus einem PDF-Dokument durch Festlegen des Seitenbereichs extrahieren.

Parsen Sie das PDF-Dokument, um Text aus bestimmten Seiten zu extrahieren - C# .NET

// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
  string MyAppKey = "";
  string MyAppSid = "";

  var configuration = new Configuration(MyAppSid, MyAppKey);

  var apiInstance = new ParseApi(configuration);
  var fileInfo = new FileInfo
  {
  FilePath = "directory/document.pdf"
  };

  var options = new TextOptions
  {
  FileInfo = fileInfo,
  StartPageNumber = 1,
  CountPagesToExtract = 2
  };

  var request = new TextRequest(options);
  var response = apiInstance.Text(request);

  // For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples

Extrahieren Sie Bilder aus Dokumenten mit der kostenlosen GroupDocs.Parser-App

Extrahieren Sie Bilder aus Dokumenten mit der kostenlosen GroupDocs.Parser-App

OSTJPEGONEMHTMLOTPODPODS

Support- und Lernressourcen

GroupDocs.Parser Cloud bietet außerdem individuelles Dokumenten-Parsing SDKs für weitere Sprachen, wie unten aufgeführt:

  Deutsch
0a8a05487