GroupDocs.Parser Cloud bietet einem .NET-Projekt eine Möglichkeit, den Inhalt eines gespeicherten Dokuments zu lesen. Ein Aufruf gibt den Dateinamen und die gewünschte Inhaltsart an, und die Antwort liefert den Text der Seiten, die darin eingebetteten Bilder oder die Metadatenfelder, die der Datei zugeordnet sind.
Vorlagen verarbeiten Dokumente mit einheitlichem Layout. Feldpositionen und Tabellenbereiche werden einmal definiert und anschließend auf jede Rechnung, Quittung oder jedes Formular dieser Art angewendet, sodass die Werte als benannte Ergebnisse zurückgeliefert werden statt als unstrukturierter Text, der noch interpretiert werden muss.
Mehr als 50 Formate werden unterstützt, darunter PDF, Word, Excel, PowerPoint, E-Mail-Nachrichten, E-Books, Archive und Webseiten. Das Parsen erfolgt auf dem Server, sodass auf dem aufrufenden Rechner nichts weiter als das SDK-Paket vorhanden sein muss.
Die Bereitstellung erfolgt über NuGet, und jede Anfrage enthält die Client-ID des Kontos samt Secret. Die Evaluierung läuft im Rahmen der kostenlosen Testphase. Der SDK-Quellcode und ausführbare Beispiele werden auf GitHub veröffentlicht für Entwickler, die die Aufrufe vor der Integration einsehen möchten.
Kostenlos testenGroupDocs.Parser Cloud SDK erleichtert .NET Entwicklern das Parsen beliebiger Dokumente, um Text, Bilder und Metadaten innerhalb .NET-basierter Anwendungen zu extrahieren. SDK (REST API Client) ist der einfachste und schnellste Weg für Sie als Entwickler, die Entwicklung zu beschleunigen. So können Sie sich darauf konzentrieren, nur den projektspezifischen Code zu schreiben und müssen sich nicht um die Low-Level-Details von Anfragen und der Verarbeitung der Antworten kümmern. Dokumente können mit einfach zu nutzenden, benutzerdefinierten Vorlagen, die Felddefinitionen und Tabellendefinitionen enthalten, geparst werden. Anschließend ist es einfach, Daten wie Textfelder, Zahlen, Tabellen aus den üblichen Dokumenten und sogar aus Containern wie ZIP-Archiven, OST/PST Mail-Datendateien, eBooks, Markups und PDF Portfolios zu extrahieren.
Sehen Sie sich unser Cloud SDKs für .NET unter GitHub an, wenn Sie den Quellcode zum Parsen von Dateien in der Cloud suchen.
Sie können GroupDocs.Parser(https://purchase.groupdocs.cloud/trial) Low-Code .NET APIs ohne Einschränkungen ausprobieren.
Drei Arten von Inhalten: Der Text der gesamten Datei oder einer ausgewählten Seite, die darin gespeicherten Bilder und die Metadaten, die ihr zugeordnet sind, wie Autor, Titel und Erstellungsdatum. Ein Template fügt dieser Liste benannte Felder und Tabellenwerte hinzu.
Ein Template beschreibt, wo die gewünschten Werte auf der Seite liegen - nach Position, nach umgebendem Text oder nach Tabellenbereich. Wird es auf ein Dokument mit diesem Layout angewendet, liefert es jeden Wert unter dem dafür vergebenen Namen zurück, was für Rechnungen und andere wiederkehrende Formulare geeignet ist.
GroupDocs.Parser Cloud API, bietet mehrere Möglichkeiten, Text aus den Dokumenten zu extrahieren. Sie können nur Text extrahieren, den formatierten Text extrahieren, indem Sie Extraktionsmodi festlegen, und Text aus bestimmten Seiten extrahieren, indem Sie einen Seitenbereich festlegen. Das folgende Beispiel zeigt, wie Sie Text aus einem PDF-Dokument durch Festlegen des Seitenbereichs extrahieren.
// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
string MyAppKey = "";
string MyAppSid = "";
var configuration = new Configuration(MyAppSid, MyAppKey);
var apiInstance = new ParseApi(configuration);
var fileInfo = new FileInfo
{
FilePath = "directory/document.pdf"
};
var options = new TextOptions
{
FileInfo = fileInfo,
StartPageNumber = 1,
CountPagesToExtract = 2
};
var request = new TextRequest(options);
var response = apiInstance.Text(request);
// For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples