Extração de Dados de Documentos SDK para .NET: Texto, Imagens

GroupDocs.Parser Cloud oferece a um projeto .NET uma forma de ler o que está dentro de um documento armazenado. Uma chamada especifica o arquivo e o tipo de conteúdo desejado, e a resposta devolve o texto das páginas, as imagens incorporadas nelas ou os campos de metadados registrados no arquivo.

Modelos lidam com documentos que compartilham um layout. As posições dos campos e as áreas de tabelas são descritas uma única vez, e então aplicadas a cada fatura, recibo ou formulário desse tipo, de modo que os valores chegam como resultados nomeados em vez de texto não estruturado que ainda precisa ser interpretado.

Mais de 50 formatos são suportados, entre eles PDF, Word, Excel, PowerPoint, mensagens de e-mail, e-books, arquivos e páginas da web. A análise é executada no servidor, portanto nada além do pacote SDK precisa estar presente na máquina que realiza a chamada.

A distribuição é feita através de NuGet, e cada solicitação inclui o Client ID da conta com seu Secret. A avaliação ocorre dentro do período de teste gratuito. O código-fonte SDK e os exemplos executáveis são publicados em GitHub para desenvolvedores que preferem ler as chamadas antes de adotá-las.

  • GroupDocs.Parser Cloud para cURL
  • GroupDocs.Parser Cloud SDK para Java
  • GroupDocs.Parser Cloud SDK para PHP
  • GroupDocs.Parser Cloud SDK para Python
  • GroupDocs.Parser Cloud SDK para Ruby
  • GroupDocs.Parser Cloud SDK para Node.js
Iniciar teste gratuito

GroupDocs.Parser Cloud SDK facilita desenvolvedores .NET a analisar qualquer documento para extrair texto, imagens e metadados em aplicações baseadas em .NET. SDK (REST API Cliente) é a maneira mais fácil e rápida para que você acelere o desenvolvimento. Isso permite que você se concentre apenas em escrever o código específico do projeto, sem se preocupar com os detalhes de baixo nível de fazer requisições e tratar as respostas. Os documentos podem ser analisados por meio de modelos definidos pelo usuário, fáceis de usar, com definições de campos de dados e de tabelas. Em seguida, é simples extrair dados como campos de texto, números, tabelas dos documentos típicos e até de contêineres como arquivos ZIP, arquivos de dados de e-mail OST/PST, eBooks, marcações e portfólios PDF.

Perguntas Frequentes

Quero criar minha própria aplicação .NET que possa analisar arquivos online?

Confira nosso Cloud SDKs para .NET em GitHub se você está procurando o código-fonte para analisar arquivos na nuvem.

Posso experimentar GroupDocs.Parser REST APIs no .NET gratuitamente?

Você pode experimentar GroupDocs.Parser Low-Code .NET APIs sem quaisquer limitações.

O que o .NET SDK pode extrair de um documento?

Três tipos de conteúdo. O texto de todo o arquivo ou de uma página escolhida, as imagens armazenadas nele e os metadados registrados, como autor, título e data de criação. Um modelo adiciona campos nomeados e valores de tabela a essa lista.

Como funciona a análise baseada em modelo?

Um modelo descreve onde os valores desejados estão na página, por posição, por texto circundante ou por região de tabela. Executá-lo em um documento com esse layout devolve cada valor sob o nome atribuído a ele, o que é adequado para faturas e outros formulários recorrentes.

Recursos do Document Parser REST API

Analisar PDF, documentos de processamento de texto, planilhas e apresentações

Analisar arquivos de modelo Microsoft Word, Excel, PowerPoint e OpenDocument

Analisar documentos e modelos habilitados para macro para MS Word, Excel e PowerPoint

Extrair o conteúdo de texto de todo o documento

Extraia texto e imagens de páginas específicas

Extraia texto formatado definindo o modo de extração

Extraia texto dos documentos em arquivos ZIP ou e-mails

Recupere documentos de e-mails, portfólios PDF e armazenamentos MS Outlook

Obtenha a contagem de páginas do documento e outras informações

Extrair texto de um documento por intervalo de páginas

GroupDocs.Parser Cloud API, oferece várias maneiras de extrair texto dos documentos. Você pode extrair apenas texto, extrair texto formatado definindo modos de extração, extrair das páginas específicas definindo um intervalo de páginas. O exemplo a seguir mostra como extrair texto de um documento PDF definindo o intervalo de páginas.

Analise o documento PDF para extrair texto de páginas específicas - C# .NET

// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
  string MyAppKey = "";
  string MyAppSid = "";

  var configuration = new Configuration(MyAppSid, MyAppKey);

  var apiInstance = new ParseApi(configuration);
  var fileInfo = new FileInfo
  {
  FilePath = "directory/document.pdf"
  };

  var options = new TextOptions
  {
  FileInfo = fileInfo,
  StartPageNumber = 1,
  CountPagesToExtract = 2
  };

  var request = new TextRequest(options);
  var response = apiInstance.Text(request);

  // For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples

Extraia imagens de documentos usando o aplicativo gratuito GroupDocs.Parser

Extraia imagens de documentos usando o aplicativo gratuito GroupDocs.Parser

Recursos de suporte e aprendizado

GroupDocs.Parser Cloud também oferece análise individual de documentos SDKs para outros idiomas, conforme listados abaixo:

  Português
9884e7cf6