Extract टेक्स्ट से एक PDF ऑनलाइन

Pull सभी selectable टेक्स्ट बाहर का एक PDF — कॉपी यह या डाउनलोड जैसे.txt.

अंतिम अपडेट:

Extract Text from PDF

Turn text-based or scanned PDFs into editable text, page by page, directly in your browser.

Upload a PDF

MAX 30 MB

Drop your PDF here

Choose a PDF up to 30 MB and 100 pages. Your document stays in your browser while it is processed.

Text extraction and OCR run in your browser. Do not upload documents you are not authorized to process. Verify names, dates, amounts, and OCR text against the original PDF.

Editable text preview

NO FILE
Choose a PDF to begin.
PAGES
DIRECT TEXT
OCR PAGES

Text PDFs are extracted directly. OCR is used only for pages with no usable embedded text when Auto mode is selected.

Extract टेक्स्ट से PDF ऑनलाइन

उपयोग यह PDF टेक्स्ट extractor को turn PDF दस्तावेज़ में editable, searchable टेक्स्ट. अपलोड एक regular PDF के साथ selectable टेक्स्ट या एक स्कैन किया हुआ दस्तावेज़ कि ज़रूरत OCR, चुनें पृष्ठ आप ज़रूरत, और समीक्षा करें extracted सामग्री पहले कॉपी या डाउनलोड यह.

यह है उपयोगी के लिए research कागज़, रिपोर्ट, चालान, मैन्युअल, फ़ॉर्म, worksheets, और अन्य दस्तावेज़ आप अपना या हैं अधिकृत को प्रक्रिया. इसके बजाय का मैन्युअल रूप से retyping टेक्स्ट, आप सकता है extract यह पृष्ठ द्वारा पृष्ठ और बनाएँ corrections सीधे में पूर्वावलोकन.

कैसे को extract टेक्स्ट से एक PDF

  1. अपलोड या drag और drop आपका PDF फ़ाइल.
  2. चुनें सभी पृष्ठ या दर्ज करें एक पृष्ठ सीमा, ऐसा जैसे 3-8, 10.
  3. चुनें स्वचालित OCR, हमेशा उपयोग OCR, या embedded-टेक्स्ट extraction केवल.
  4. चुनें OCR language के लिए स्कैन किया हुआ दस्तावेज़.
  5. Extract टेक्स्ट और समीक्षा करें यह में editable पूर्वावलोकन.
  6. कॉपी सभी टेक्स्ट या डाउनलोड परिणाम जैसे एक TXT फ़ाइल.

टूल preserves पृष्ठ separators इसलिए आप सकता है देखें जहाँ प्रत्येक अनुभाग का टेक्स्ट came से.

टेक्स्ट-आधारित PDF बनाम. स्कैन किया हुआ PDF

नहीं हर PDF stores इसका टेक्स्ट में समान तरीका.

टेक्स्ट-आधारित PDF

एक टेक्स्ट-आधारित PDF शामिल है embedded, selectable टेक्स्ट. यह है सामान्य में रिपोर्ट, डिजिटल मैन्युअल, exported दस्तावेज़, और research कागज़. टूल सकता है read यह टेक्स्ट सीधे, कौन सा है आमतौर पर तेज़ और अधिक सटीक से OCR.

स्कैन किया हुआ PDF

एक स्कैन किया हुआ PDF है made से पृष्ठ छवियाँ, ऐसा जैसे स्कैन किया हुआ नहीं, receipts, books, या प्रिंट फ़ॉर्म. क्योंकि टेक्स्ट है part का एक छवि, यह cannot सामान्यतः होना चयनित. OCR, या optical अक्षर recognition, analyzes पृष्ठ छवि और परिवर्तित करता है दृश्य अक्षर में editable टेक्स्ट.

OCR है उपयोगी, लेकिन यह है नहीं perfect. छोटा टेक्स्ट, हस्तलेखन, unusual fonts, low-गुणवत्ता scans, tables, सूत्र, और blurred छवियाँ सकता है उत्पन्न करें recognition त्रुटियाँ. हमेशा जाँचें महत्वपूर्ण नाम, तारीखें, संदर्भ संख्याएँ, और राशि के विरुद्ध मूल दस्तावेज़.

Extract चयनित पृष्ठ केवल

आप करें नहीं ज़रूरत को extract हर पृष्ठ का एक लंबा दस्तावेज़. दर्ज करें एक पृष्ठ सीमा कब आप केवल ज़रूरत एक विशिष्ट chapter, चालान पृष्ठ, appendix, या अनुभाग.

उदाहरण के लिए:

  • all extracts हर पृष्ठ
  • 3-8 extracts पृष्ठ 3 के माध्यम से 8
  • 1, 4, 7 extracts व्यक्तिगत पृष्ठ
  • 2-5, 9, 12-14 combines कई सीमा

Extracting केवल पृष्ठ आप ज़रूरत सकता है बनाएँ समीक्षा करना और organizing टेक्स्ट आसान.

Editable PDF टेक्स्ट पूर्वावलोकन

बाद extraction, आउटपुट दिखाई देता है में एक editable टेक्स्ट क्षेत्र. आप सकता है सही OCR गलतियाँ, हटाएँ unwanted पंक्ति, जोड़ें नहीं, या तैयार करें सामग्री के लिए translation, summarization, research, accessibility काम, या लेखन.

डाउनलोड TXT फ़ाइल reflects कोई edits आप बनाएँ में पूर्वावलोकन.

हटाएँ repeated headers और footers

कई PDF repeat समान दस्तावेज़ शीर्षक, पृष्ठ संख्या, company name, या footer पर हर पृष्ठ. कब यह विकल्प है enabled, टूल जाँचें के लिए repeated पहला और अंतिम पंक्ति भर में कई पृष्ठ और हटाएँ उन्हें जहाँ संभव.

समीक्षा करें परिणाम बाद उपयोग करके यह विकल्प क्योंकि एक repeated पंक्ति हो सकता है कभी-कभी होना meaningful सामग्री.

गोपनीयता और दस्तावेज़ संभालें

दस्तावेज़ सकता है शामिल करते हैं confidential जानकारी. यह टूल प्रक्रिया PDF सामग्री आपके ब्राउज़र में के लिए टेक्स्ट extraction और OCR; PDF itself है नहीं sent को एक दस्तावेज़-प्रक्रिया server द्वारा टूल.

केवल अपलोड दस्तावेज़ आप हैं अधिकृत को पहुँच और प्रक्रिया. बचें साझा करना confidential फ़ाइलें पर सार्वजनिक या untrusted डिवाइस, और स्पष्ट पूर्वावलोकन कब आप हैं पूर्ण.

सामान्य PDF टेक्स्ट extraction उपयोग करता है

  • कॉपी टेक्स्ट से research कागज़ और शैक्षणिक articles
  • परिवर्तित करें स्कैन किया हुआ नहीं में editable अध्ययन सामग्री
  • Extract चालान विवरण और report सामग्री
  • तैयार करें अपना दस्तावेज़ के लिए translation या summarization
  • बनाएँ दस्तावेज़ टेक्स्ट आसान को उपयोग के साथ screen readers
  • Reuse अधिकृत मैन्युअल, फ़ॉर्म, या policy टेक्स्ट
  • बनाएँ searchable नहीं से स्कैन किया हुआ पृष्ठ
  • Export चयनित PDF पृष्ठ जैसे plain टेक्स्ट

PDF टेक्स्ट extractor FAQs

सकता है मैं extract टेक्स्ट से एक स्कैन किया हुआ PDF?

हाँ. चुनें स्वचालित OCR या OCR के लिए हर पृष्ठ. टूल उपयोग करता है OCR कब एक पृष्ठ करता है नहीं शामिल करते हैं usable embedded टेक्स्ट.

क्यों करता है extracted टेक्स्ट कभी-कभी look अलग से PDF?

PDF हो सकता है उपयोग columns, floating टेक्स्ट boxes, tables, headers, और unusual layouts. extractor उपयोग करता है एक sensible पंक्ति-आधारित पढ़ना क्रम जहाँ संभव, लेकिन जटिल पृष्ठ हो सकता है ज़रूरत मैन्युअल संपादन afterward.

सकता है मैं कॉपी टेक्स्ट से एक पासवर्ड-protected PDF?

आप सकता है दर्ज करें पासवर्ड केवल कब आप हैं अधिकृत को खोलें दस्तावेज़. यदि PDF cannot होना खोलें या है damaged, टूल होगा प्रदर्शन एक error.

सकता है मैं extract टेक्स्ट से केवल एक कुछ पृष्ठ?

हाँ. उपयोग एक पृष्ठ सीमा ऐसा जैसे 3-8 या combine सीमा ऐसा जैसे 1-3, 7, 10-12.

करता है OCR guarantee perfect टेक्स्ट?

नहीं. OCR accuracy निर्भर पर scan गुणवत्ता, language, font, resolution, हस्तलेखन, और पृष्ठ layout. सत्यापित करें critical विवरण पहले relying पर extracted टेक्स्ट.

क्या है सर्वश्रेष्ठ आउटपुट फ़ॉर्मेट के लिए सरल editable टेक्स्ट?

TXT है ideal के लिए साफ़, lightweight, searchable टेक्स्ट. आप सकता है खोलें यह में Notepad, TextEdit, शब्द, Google Docs, या अधिकांश लेखन और research टूल्स.