GroupDocs.Parser Cloud به پروژهٔ .NET یک روش برای خواندن محتوای داخل یک سند ذخیرهشده میدهد. یک فراخوانی نام فایل و نوع محتوای موردنظر را مشخص میکند و پاسخ متن صفحات، تصاویر تعبیهشده در آنها یا فیلدهای فراداده ثبتشده برای فایل را برمیگرداند.
قالبها اسنادی را که طرح مشترکی دارند، مدیریت میکنند. موقعیت فیلدها و نواحی جدول یکبار توصیف میشوند و سپس بر روی هر فاکتور، رسید یا فرم از این نوع اعمال میشوند، بهطوری که مقادیر بهصورت نتایج نامگذاریشده باز میگردند نه متن نامنظم که نیاز به تفسیر دارد.
بیش از ۵۰ فرمت پشتیبانی میشود که شامل PDF، Word، Excel، PowerPoint، پیامهای ایمیل، کتابهای الکترونیکی، بایگانیها و صفحات وب میباشد. تجزیه-تحلیل بر روی سرور انجام میشود، بنابراین چیزی فراتر از بستهٔ SDK بر روی ماشینی که فراخوانی را انجام میدهد، لازم نیست.
توزیع از طریق NuGet انجام میشود و هر درخواست شناسهٔ مشتری (Client ID) حساب به همراه رمز (Secret) آن را حمل میکند. ارزیابی در داخل دورهٔ آزمایشی رایگان اجرا میشود. کد منبع و نمونههای اجرایی SDK در GitHub برای توسعهدهندگانی که ترجیح میدهند قبل از استفاده فراخوانیها را مطالعه کنند، منتشر شدهاند.
آزمایش رایگان را شروع کنیدGroupDocs.Parser Cloud SDK به شما، توسعهدهندگان .NET، امکان میدهد هر سندی را برای استخراج متن، تصویر و فراداده در برنامههای مبتنی بر .NET تجزیه کنید. SDK (کلاینت REST API) سادهترین و سریعترین راه برای شما، توسعهدهنده، برای تسریع در توسعه است. این به شما اجازه میدهد تا فقط بر نوشتن کدهای مخصوص پروژه تمرکز کنید و نگران جزئیات سطح پایین ارسال درخواستها و پردازش پاسخها نباشید. اسناد میتوانند با قالبهای تعریفشده توسط کاربر، که استفاده از آنها آسان است و شامل تعریف فیلدهای داده و جدولها میشوند، تجزیه شوند. سپس استخراج دادههایی مانند فیلدهای متنی، اعداد و جدولها از اسناد معمولی و حتی از مخازنی مانند آرشیوهای ZIP، فایلهای داده ایمیل OST/PST، کتابهای الکترونیکی، نشانهگذاریها و پرتفویهای PDF به سادگی امکانپذیر است.
اگر به دنبال کد منبع برای تجزیهٔ فایلها در ابر هستید، Cloud SDKs ما را برای .NET در GitHub بررسی کنید.
شما میتوانید GroupDocs.Parser را امتحان کنید (https://purchase.groupdocs.cloud/trial) Low-Code .NET APIs بدون هیچ محدودیتی.
سه نوع محتوا وجود دارد. متن کل فایل یا صفحهای که انتخاب میکنید، تصاویر ذخیرهشده در آن، و فرادادههای ثبتشده مانند نویسنده، عنوان و تاریخ ایجاد. یک الگو فیلدهای نامگذاریشده و مقادیر جدول را به این فهرست اضافه میکند.
یک الگو مکان مقادیر موردنظر را در صفحه توصیف میکند، بر اساس موقعیت، متن اطراف یا ناحیه جدول. اجرای آن بر روی سندی با همان چیدمان، هر مقدار را تحت نامی که به آن اختصاص داده شده برمیگرداند، که برای فاکتورها و سایر فرمهای تکراری مناسب است.
GroupDocs.Parser Cloud API، چندین روش برای استخراج متن از اسناد فراهم میکند. میتوانید فقط متن را استخراج کنید، متن قالببندیشده را با تنظیم حالتهای استخراج استخراج کنید، یا از صفحات خاص با تنظیم بازهٔ صفحات استخراج کنید. مثال زیر نشان میدهد چگونه میتوان متن را از یک سند PDF با تنظیم بازهٔ صفحه استخراج کرد.
// Get AppKey and AppSID from https://dashboard.groupdocs.cloud
string MyAppKey = "";
string MyAppSid = "";
var configuration = new Configuration(MyAppSid, MyAppKey);
var apiInstance = new ParseApi(configuration);
var fileInfo = new FileInfo
{
FilePath = "directory/document.pdf"
};
var options = new TextOptions
{
FileInfo = fileInfo,
StartPageNumber = 1,
CountPagesToExtract = 2
};
var request = new TextRequest(options);
var response = apiInstance.Text(request);
// For complete examples, visit https://github.com/groupdocs-parser-cloud/groupdocs-parser-cloud-dotnet-samples