PDFIntact

अपने PDF से तालिकाएँ और मूल पाठ ज्यों का त्यों निकालें

स्कैन किए PDF में अक्षर चुने या कॉपी नहीं किए जा सकते

दफ़्तर के स्कैनर से आए दस्तावेज़ में आप पाठ चुनने की कोशिश करते हैं और कुछ नहीं होता। खोजने पर कुछ नहीं मिलता। खींचने पर शब्दों के बजाय एक आयत चुना जाता है।

इसका कारण यह है कि वह फ़ाइल केवल काग़ज़ का चित्र है। स्कैनर यह सहेजता है कि पृष्ठ दिखता कैसा है। आपकी आँख के लिए वह पाठ है; फ़ाइल के भीतर वह किसी तस्वीर से अलग नहीं। वहाँ अक्षर-आँकड़े हैं ही नहीं, इसलिए न कुछ चुनने को है, न कॉपी करने को, न खोजने को।

उसे निकालने के लिए चित्र में से अक्षर पढ़ने पड़ते हैं। हल्की छपाई, टेढ़ापन और कम विभेदन — ये सब ऐसे अंश बनाते हैं जो पढ़े नहीं जा सकते। PDFIntact उन्हें खाली छोड़ने के बजाय «पढ़ा नहीं जा सका» चिह्नित करता है — चुपचाप भर देना ही वह चीज़ है जो ग़लती को पकड़ में न आने देती।

अभी आज़माइए

अपने ही PDF पर जाँचिए

जाँच पूरी तरह आपके ब्राउज़र के भीतर चलती है। फ़ाइल कहीं नहीं भेजी जाती और खाता भी नहीं चाहिए। भुगतान से पहले ही देख लीजिए कि कितने पृष्ठ, तालिकाएँ और आकृतियाँ निकाली जा सकती हैं।

उदाहरण

まず見分けてください

同じ「PDF」でも、原因によって対処が変わります。次のどれに当てはまるかで判断できます。

文字を選択できない・検索しても出てこない
スキャンPDF(画像)です。このページの対象です。
選択もコピーもできるが、貼り付けると読めない文字になる
画像ではなく、フォントの対応表が欠けている状態です。PDFをコピーすると文字化けする をご覧ください。
文字は取り出せるが、表の行と列がずれる
PDFが表の構造を持っていないためです。PDFの表をExcelに貼り付けるとずれる をご覧ください。

अक्सर पूछे जाने वाले प्रश्न

स्कैन किए PDF से पाठ कॉपी क्यों नहीं होता?
क्योंकि PDF में अक्षर-आँकड़े नहीं, पृष्ठ की तस्वीर होती है। आपको वह पाठ लगता है, पर फ़ाइल के लिए वह एक चित्र है — इसलिए न कुछ चुनने को है, न खोजने को।
इसे चुनने योग्य कैसे बनाऊँ?
अक्षरों को चित्र में से पहचानना पड़ता है। PDFIntact हर पृष्ठ का विश्लेषण करके पाठ, तालिकाएँ और ग्राफ़ को Excel, Word, Markdown या JSON में निर्यात करता है। भुगतान से पहले आप ब्राउज़र में जाँच सकते हैं कि आपकी फ़ाइल पढ़ी जा सकती है या नहीं।
क्या हस्तलेख पढ़ा जा सकता है?
पूरी तरह हस्तलेख वाले दस्तावेज़ दायरे से बाहर हैं। इसे मुख्यतः छपे हुए दस्तावेज़ों के लिए काम में लीजिए। क्या नहीं बदला जा सकता, यह जाँच ख़रीद से पहले बता देती है।
क्या स्कैन दस्तावेज़ों की तालिकाएँ निकाली जा सकती हैं?
हाँ, रेखाओं और जुड़ी कोशिकाओं सहित। हल्की छपाई, टेढ़ापन या कम विभेदन कुछ अंश अपठित छोड़ देते हैं; उन्हें अनुमान से भरने के बजाय «पढ़ा नहीं जा सका» बताया जाता है।
मेरी भेजी फ़ाइल का क्या होता है?
जाँच पूरी तरह आपके ब्राउज़र में होती है और मूल फ़ाइल कभी अपलोड नहीं होती। रूपांतरण के लिए भेजा गया PDF 24 घंटे के भीतर मिटा दिया जाता है, और रचना के अनुसार भुगतान पूरा होने तक कुछ भी हमारे सर्वर तक नहीं पहुँचता।

किसी भी PDF को सभी लक्षणों पर जाँचिएकिस प्रारूप में क्या आता है