PdfExtractor

अवलोकन

PdfExtractor यह एक क्लास है Aspose.PDF FOSS के लिए .NET. वारिस से: IDisposable.

एक पीडीएफ दस्तावेज़ से पाठ और छवियों को निकालने के लिए चेक।.

इस वर्ग में .NET प्रोग्रामों में PdfExtractor वस्तुओं के साथ काम करने के लिए 29 तरीके प्रदान किए जाते हैं।. उपलब्ध तरीकों में शामिल हैं: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText,और तीन अतिरिक्त तरीके।. सभी सार्वजनिक सदस्य किसी भी .NET अनुप्रयोग के लिए उपलब्ध हैं Aspose.PDF FOSS को स्थापित करने के बाद .Net पैकेज के साथ।. संपत्ति : EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution,और दो और।.

गुण

NameTypeAccessDescription
StartPageintपढ़ना / लिखना1-based start page for extraction.
EndPageintपढ़ना / लिखना1-based end page for extraction.
ExtractTextModeintपढ़ना / लिखनापाठ निकालने का तरीका।.
ExtractImageModeExtractImageModeपढ़ना / लिखनाImage Extraction की रणनीति।.
Resolutionintपढ़ना / लिखनाRendering Resolution for Image Extraction (DPI) के लिए रिलेशनशिप।.
IsBidiboolReadयह सच है जब सबसे हाल ही में निकाले गए पाठ में दाईं ओर-बाएं स्क्रिप्ट चलता है (हिब्रू, अरबी, सीरियाई, थाना आदि), अर्थात।.
Passwordstring?पढ़ना / लिखनाएन्क्रिप्टेड पीडीएफ को बाध्य करने के लिए उपयोग किए जाने वाले पासवर्ड।.
TextSearchOptionsAspose.Pdf.Text.TextSearchOptionsपढ़ना / लिखनापाठ खोज विकल्प ExtractText() के दौरान लागू किए गए थे।.

विधियाँ

SignatureDescription
PdfExtractor()इस उदाहरण पर PdfExtractor कॉल करें।.
PdfExtractor(document: Document)
BindPdf(inputFile: string)इस उदाहरण पर BindPdf कॉल करें।.
BindPdf(document: Document)
BindPdf(inputStream: Stream)
ExtractText()TextAbsorber के साथ बाध्य दस्तावेज़ में प्रत्येक पृष्ठ चलता है और निकाले गए पाठ को संकुचित करता है।.
ExtractText(outputFile: string)पाठ को बांड पीडीएफ से निकाल दें और इसे दिए गए फ़ाइल (UTF-16 LE बाइट्स) में सहेजें।.
ExtractText(encoding: Encoding)पाठ को दिए गए एन्कोडिंग का उपयोग करके बांड पीडीएफ से निकालना।.
GetText(outputStream: Stream)निकाल दिया गया पाठ बाइट्स के रूप में आउटपुट स्ट्रीम में लिखता है, नवीनतम ExtractText(Encoding) कॉल द्वारा निर्धारित कोडिंग का उपयोग करके (UTF-16 LE के लिए डिफ़ॉल्ट)।.
GetText(outputStream: Stream, filterNotAscii: bool)यह निकाले गए पाठ को बाइट्स के रूप में लिखता है, वैकल्पिक रूप से गैर-एएससीआई कोडपॉइंट पहले छोड़ देता है।.
GetText(outputFile: string)उस फ़ाइल मार्ग पर निकाले गए पाठ को लिखें।.
HasNextPageText()यह सच है यदि GetNextPageText के माध्यम से एक और पृष्ठ का पाठ उपलब्ध है।.
GetNextPageText(outputFile: string)अगली पृष्ठ का पाठ दिए गए फ़ाइल मार्ग (UTF-16 LE बाइट्स) पर लिखें।.
GetNextPageText(outputStream: Stream)अगली पृष्ठ का पाठ उस प्रवाह में लिखें (UTF-16 LE बाइट्स)।.
ExtractImage()इस उदाहरण पर ExtractImage कॉल करें।.
ExtractImage(outputDirectory: string)प्रत्येक छवि को दिए गए निर्देशिका में निकालना, फ़ाइलों image_N.jpg के लिए JPEG स्रोतों और image-N .png का नाम देना।.
HasNextImage()सच है जबकि GetNextImage(string) में लिखने के लिए एक शेष छवि है।.
GetNextImage(outputStream: Stream)इस उदाहरण पर GetNextImage कॉल करें।.
GetNextImage(outputFile: string)
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat)
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat)
ExtractAttachment()बंधे हुए दस्तावेज़ में प्रत्येक अंतर्निहित फ़ाइल का चयन करें; एक बाद GetAttachment(string) उन सभी को लिखता है।.
ExtractAttachment(attachmentFileName: string)निकालने के लिए नाम से एक अंदरूनी फ़ाइल का चयन करें।.
GetAttachNames()प्रत्येक फ़ाइल का नाम बांड दस्तावेज़ में शामिल है।.
GetAttachmentInfo()FileSpecification प्रत्येक अंतर्निहित फ़ाइल के लिए बांड दस्तावेज़ में प्रवेश करता है।.
GetAttachment()चयनित अनुलग्नकों की सामग्री को MemoryStreams के रूप में वापस करें (सभी अनुप्रयोग जब कोई स्पष्ट रूप से नहीं चुना गया था)।.
GetAttachment(outputPath: string)चयनित अनुलग्नक (सभी जब कोई स्पष्ट रूप से नहीं चुना गया) को आउटपुटपैथ निर्देशिका में लिखें, प्रत्येक अनुभाग के लिए एक फ़ाइल जिसका नाम उसके फ़ील्ड नाम के बाद है।.
Close()इस PdfExtractor उदाहरण पर निकट कॉल करें।.
Dispose()इस संस्करण पर कॉल उपलब्ध है।.

यह भी देखें

 हिन्दी