GroupDocs.Parser Cloud le brinda a un proyecto .NET una forma de leer lo que hay dentro de un documento almacenado. Una llamada especifica el archivo y el tipo de contenido que deseas, y la respuesta devuelve el texto de las páginas, las imágenes incrustadas en ellas o los campos de metadatos registrados en el archivo.
Las plantillas gestionan documentos que comparten un mismo diseño. Las posiciones de los campos y las áreas de tablas se describen una sola vez y luego se aplican a cada factura, recibo o formulario de ese tipo, de modo que los valores llegan como resultados nombrados en lugar de texto sin estructurar que aún debe interpretarse.
Se admiten más de 50 formatos, entre ellos PDF, Word, Excel, PowerPoint, mensajes de correo electrónico, libros electrónicos, archivos y páginas web. El análisis se ejecuta en el servidor, por lo que no es necesario que nada más que el paquete SDK esté presente en la máquina que realiza la llamada.
La distribución se realiza a través de NuGet, y cada solicitud lleva el ID de cliente de la cuenta con su secreto. La evaluación se ejecuta dentro de la prueba gratuita. El código fuente de SDK y los ejemplos ejecutables se publican en GitHub para los desarrolladores que prefieren leer las llamadas antes de adoptarlas.
Empiza la prueba gratuitaGroupDocs.Parser Cloud SDK facilita a los desarrolladores de .NET analizar cualquier documento para extraer texto, imágenes y metadatos dentro de aplicaciones basadas en .NET. SDK (Cliente REST API) es la forma más fácil y rápida para que el desarrollador acelere el desarrollo. Esto permite al desarrollador centrarse únicamente en escribir el código específico del proyecto y no preocuparse por los detalles de bajo nivel de realizar solicitudes y manejar las respuestas. Los documentos pueden analizarse mediante plantillas definidas por el usuario, fáciles de usar, con definiciones de campos de datos y de tablas. Luego es sencillo extraer datos como campos de texto, números, tablas de los documentos típicos e incluso de contenedores como archivos ZIP, archivos de datos de correo OST/PST, eBooks, marcas y portafolios PDF.
Consulta nuestro Cloud SDKs para .NET en GitHub si buscas el código fuente para analizar archivos en la nube.
Puedes probar GroupDocs.Parser Low-Code .NET APIs sin ninguna limitación.
Tres tipos de contenido. El texto de todo el archivo o de una página elegida, las imágenes almacenadas dentro de él, y los metadatos registrados, como autor, título y fecha de creación. Una plantilla añade campos con nombre y valores de tabla a esa lista.
Una plantilla describe dónde se encuentran los valores deseados en la página, por posición, por texto circundante o por región de tabla. Ejecutarla contra un documento con ese diseño devuelve cada valor bajo el nombre asignado, lo que resulta adecuado para facturas y otros formularios repetitivos.
GroupDocs.Parser Cloud API ofrece varias formas de extraer texto de los documentos. Puedes extraer solo texto, extraer texto con formato configurando los modos de extracción y extraer texto de páginas específicas estableciendo un rango de páginas. El siguiente ejemplo muestra cómo extraer texto de un documento PDF estableciendo un rango de páginas.
// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
string MyAppKey = "";
string MyAppSid = "";
var configuration = new Configuration(MyAppSid, MyAppKey);
var apiInstance = new ParseApi(configuration);
var fileInfo = new FileInfo
{
FilePath = "directory/document.pdf"
};
var options = new TextOptions
{
FileInfo = fileInfo,
StartPageNumber = 1,
CountPagesToExtract = 2
};
var request = new TextRequest(options);
var response = apiInstance.Text(request);
// For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples