استخراج داده‌های سند SDK برای .NET: متن، تصاویر

GroupDocs.Parser Cloud به پروژهٔ .NET یک روش برای خواندن محتوای داخل یک سند ذخیره‌شده می‌دهد. یک فراخوانی نام فایل و نوع محتوای موردنظر را مشخص می‌کند و پاسخ متن صفحات، تصاویر تعبیه‌شده در آن‌ها یا فیلدهای فراداده ثبت‌شده برای فایل را برمی‌گرداند.

قالب‌ها اسنادی را که طرح مشترکی دارند، مدیریت می‌کنند. موقعیت فیلدها و نواحی جدول یک‌بار توصیف می‌شوند و سپس بر روی هر فاکتور، رسید یا فرم از این نوع اعمال می‌شوند، به‌طوری که مقادیر به‌صورت نتایج نام‌گذاری‌شده باز می‌گردند نه متن نامنظم که نیاز به تفسیر دارد.

بیش از ۵۰ فرمت پشتیبانی می‌شود که شامل PDF، Word، Excel، PowerPoint، پیام‌های ایمیل، کتاب‌های الکترونیکی، بایگانی‌ها و صفحات وب می‌باشد. تجزیه-تحلیل بر روی سرور انجام می‌شود، بنابراین چیزی فراتر از بستهٔ SDK بر روی ماشینی که فراخوانی را انجام می‌دهد، لازم نیست.

توزیع از طریق NuGet انجام می‌شود و هر درخواست شناسهٔ مشتری (Client ID) حساب به همراه رمز (Secret) آن را حمل می‌کند. ارزیابی در داخل دورهٔ آزمایشی رایگان اجرا می‌شود. کد منبع و نمونه‌های اجرایی SDK در GitHub برای توسعه‌دهندگانی که ترجیح می‌دهند قبل از استفاده فراخوانی‌ها را مطالعه کنند، منتشر شده‌اند.

  • GroupDocs.Parser Cloud برای cURL
  • GroupDocs.Parser Cloud SDK برای Java
  • GroupDocs.Parser Cloud SDK برای PHP
  • GroupDocs.Parser Cloud SDK برای Python
  • GroupDocs.Parser Cloud SDK برای Ruby
  • GroupDocs.Parser Cloud SDK برای Node.js
آزمایش رایگان را شروع کنید

GroupDocs.Parser Cloud SDK به شما، توسعه‌دهندگان .NET، امکان می‌دهد هر سندی را برای استخراج متن، تصویر و فراداده در برنامه‌های مبتنی بر .NET تجزیه کنید. SDK (کلاینت REST API) ساده‌ترین و سریع‌ترین راه برای شما، توسعه‌دهنده، برای تسریع در توسعه است. این به شما اجازه می‌دهد تا فقط بر نوشتن کدهای مخصوص پروژه تمرکز کنید و نگران جزئیات سطح پایین ارسال درخواست‌ها و پردازش پاسخ‌ها نباشید. اسناد می‌توانند با قالب‌های تعریف‌شده توسط کاربر، که استفاده از آن‌ها آسان است و شامل تعریف فیلدهای داده و جدول‌ها می‌شوند، تجزیه شوند. سپس استخراج داده‌هایی مانند فیلدهای متنی، اعداد و جدول‌ها از اسناد معمولی و حتی از مخازنی مانند آرشیوهای ZIP، فایل‌های داده ایمیل OST/PST، کتاب‌های الکترونیکی، نشانه‌گذاری‌ها و پرتفوی‌های PDF به سادگی امکان‌پذیر است.

سوالات متداول

می‌خواهم برنامهٔ .NET خودم را بسازم که بتواند فایل‌ها را به‌صورت آنلاین تجزیه کند؟

اگر به دنبال کد منبع برای تجزیهٔ فایل‌ها در ابر هستید، Cloud SDKs ما را برای .NET در GitHub بررسی کنید.

آیا می‌توانم GroupDocs.Parser REST APIs را بر روی .NET به‌صورت رایگان امتحان کنم؟

شما می‌توانید GroupDocs.Parser را امتحان کنید (https://purchase.groupdocs.cloud/trial) Low-Code .NET APIs بدون هیچ محدودیتی.

.NET SDK می‌تواند چه چیزی را از یک سند استخراج کند؟

سه نوع محتوا وجود دارد. متن کل فایل یا صفحه‌ای که انتخاب می‌کنید، تصاویر ذخیره‌شده در آن، و فراداده‌های ثبت‌شده مانند نویسنده، عنوان و تاریخ ایجاد. یک الگو فیلدهای نام‌گذاری‌شده و مقادیر جدول را به این فهرست اضافه می‌کند.

چگونه تجزیه و تحلیل مبتنی بر الگو کار می‌کند؟

یک الگو مکان مقادیر موردنظر را در صفحه توصیف می‌کند، بر اساس موقعیت، متن اطراف یا ناحیه جدول. اجرای آن بر روی سندی با همان چیدمان، هر مقدار را تحت نامی که به آن اختصاص داده شده برمی‌گرداند، که برای فاکتورها و سایر فرم‌های تکراری مناسب است.

ویژگی‌های پارسر سند REST API

تجزیه PDF، اسناد پردازش متن، صفحات گسترده و ارائه‌ها

تجزیه فایل‌های قالب Microsoft Word، Excel، PowerPoint و OpenDocument

تجزیه اسناد و قالب‌های دارای ماکرو برای MS Word، Excel و PowerPoint

استخراج محتوای متنی از کل سند

متن و تصاویر را از صفحات خاص استخراج کنید

متن قالب‌بندی‌شده را با تنظیم حالت استخراج استخراج کنید

متن را از اسناد موجود در آرشیوهای ZIP یا ایمیل‌ها استخراج کنید

اسناد را از ایمیل‌ها، پرتفوی‌های PDF و ذخیره‌سازی‌های MS Outlook بازیابی کنید

تعداد صفحات سند و سایر اطلاعات را دریافت کنید

استخراج متن از سند بر اساس بازهٔ شمارهٔ صفحات

GroupDocs.Parser Cloud API، چندین روش برای استخراج متن از اسناد فراهم می‌کند. می‌توانید فقط متن را استخراج کنید، متن قالب‌بندی‌شده را با تنظیم حالت‌های استخراج استخراج کنید، یا از صفحات خاص با تنظیم بازهٔ صفحات استخراج کنید. مثال زیر نشان می‌دهد چگونه می‌توان متن را از یک سند PDF با تنظیم بازهٔ صفحه استخراج کرد.

سند PDF را تجزیه کنید تا متن را از صفحات خاص استخراج کنید - C# .NET

// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
  string MyAppKey = "";
  string MyAppSid = "";

  var configuration = new Configuration(MyAppSid, MyAppKey);

  var apiInstance = new ParseApi(configuration);
  var fileInfo = new FileInfo
  {
  FilePath = "directory/document.pdf"
  };

  var options = new TextOptions
  {
  FileInfo = fileInfo,
  StartPageNumber = 1,
  CountPagesToExtract = 2
  };

  var request = new TextRequest(options);
  var response = apiInstance.Text(request);

  // For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples

Extract images from Documents using GroupDocs.Parser Free App

Extract images from Documents using GroupDocs.Parser Free App

Support and Learning Resources

GroupDocs.Parser Cloud همچنین تجزیهٔ سندهای فردی SDKs را برای زبان‌های دیگر به شرح زیر ارائه می‌دهد:

  فارسی
06b0eb4a5