GroupDocs.Parser Cloud oferece a um projeto .NET uma forma de ler o que está dentro de um documento armazenado. Uma chamada especifica o arquivo e o tipo de conteúdo desejado, e a resposta devolve o texto das páginas, as imagens incorporadas nelas ou os campos de metadados registrados no arquivo.
Modelos lidam com documentos que compartilham um layout. As posições dos campos e as áreas de tabelas são descritas uma única vez, e então aplicadas a cada fatura, recibo ou formulário desse tipo, de modo que os valores chegam como resultados nomeados em vez de texto não estruturado que ainda precisa ser interpretado.
Mais de 50 formatos são suportados, entre eles PDF, Word, Excel, PowerPoint, mensagens de e-mail, e-books, arquivos e páginas da web. A análise é executada no servidor, portanto nada além do pacote SDK precisa estar presente na máquina que realiza a chamada.
A distribuição é feita através de NuGet, e cada solicitação inclui o Client ID da conta com seu Secret. A avaliação ocorre dentro do período de teste gratuito. O código-fonte SDK e os exemplos executáveis são publicados em GitHub para desenvolvedores que preferem ler as chamadas antes de adotá-las.
Iniciar teste gratuitoGroupDocs.Parser Cloud SDK facilita desenvolvedores .NET a analisar qualquer documento para extrair texto, imagens e metadados em aplicações baseadas em .NET. SDK (REST API Cliente) é a maneira mais fácil e rápida para que você acelere o desenvolvimento. Isso permite que você se concentre apenas em escrever o código específico do projeto, sem se preocupar com os detalhes de baixo nível de fazer requisições e tratar as respostas. Os documentos podem ser analisados por meio de modelos definidos pelo usuário, fáceis de usar, com definições de campos de dados e de tabelas. Em seguida, é simples extrair dados como campos de texto, números, tabelas dos documentos típicos e até de contêineres como arquivos ZIP, arquivos de dados de e-mail OST/PST, eBooks, marcações e portfólios PDF.
Confira nosso Cloud SDKs para .NET em GitHub se você está procurando o código-fonte para analisar arquivos na nuvem.
Você pode experimentar GroupDocs.Parser Low-Code .NET APIs sem quaisquer limitações.
Três tipos de conteúdo. O texto de todo o arquivo ou de uma página escolhida, as imagens armazenadas nele e os metadados registrados, como autor, título e data de criação. Um modelo adiciona campos nomeados e valores de tabela a essa lista.
Um modelo descreve onde os valores desejados estão na página, por posição, por texto circundante ou por região de tabela. Executá-lo em um documento com esse layout devolve cada valor sob o nome atribuído a ele, o que é adequado para faturas e outros formulários recorrentes.
GroupDocs.Parser Cloud API, oferece várias maneiras de extrair texto dos documentos. Você pode extrair apenas texto, extrair texto formatado definindo modos de extração, extrair das páginas específicas definindo um intervalo de páginas. O exemplo a seguir mostra como extrair texto de um documento PDF definindo o intervalo de páginas.
// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
string MyAppKey = "";
string MyAppSid = "";
var configuration = new Configuration(MyAppSid, MyAppKey);
var apiInstance = new ParseApi(configuration);
var fileInfo = new FileInfo
{
FilePath = "directory/document.pdf"
};
var options = new TextOptions
{
FileInfo = fileInfo,
StartPageNumber = 1,
CountPagesToExtract = 2
};
var request = new TextRequest(options);
var response = apiInstance.Text(request);
// For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples