🌐 हिन्दी

pdftoepub.co

आपकी PDF को पन्नों की तस्वीरों के रूप में नहीं लपेटता — पाठ को शुरू से दोबारा बनाता है और हर स्क्रीन पर फिट होने वाली, सच में रीफ़्लो होने वाली EPUB 3 तैयार करता है।

विज्ञापन
अपनी PDF फ़ाइल चुनें टैप करें या खींचकर छोड़ें — अधिकतम 100 MB

‘बदलें’ दबाकर आप पुष्टि करते हैं कि अपलोड की जा रही फ़ाइल पर काम करने का अधिकार आपके पास है।

विज्ञापन

स्कैन की गई PDF को EPUB में बदलना मुश्किल क्यों है?

जब कोई दस्तावेज़ स्कैन किया जाता है तो PDF के भीतर असल में पन्नों की तस्वीरें होती हैं। पाठ बाद में OCR सॉफ़्टवेयर बनाता है और उसे तस्वीर के ऊपर एक अदृश्य परत की तरह रख दिया जाता है। उस परत में यह दर्ज नहीं होता कि अनुच्छेद कहाँ शुरू होता है, कौन-सी पंक्ति शीर्षक है या कौन-सा शब्द इटैलिक है — उसमें बस अलग-अलग पंक्तियाँ होती हैं जिनकी पन्ने पर जगह भर पता होती है।

साधारण कनवर्टर इन पंक्तियों को जस का तस उठा लेते हैं। नतीजा ऐसी फ़ाइल होती है जिसमें हर पंक्ति अलग अनुच्छेद बन जाती है, पृष्ठ संख्याएँ वाक्यों के बीच आ घुसती हैं और शब्द बीच से टूटे रहते हैं। यह टूल इसके बजाय पाठ को शुरू से दोबारा बनाता है

रूपांतरण के दौरान क्या-क्या होता है?

समस्याक्या किया जाता है
वॉटरमार्क और पेज हेडरज़्यादातर पन्नों पर दोहराई जाने वाली छोटी पंक्तियाँ, हाशिये का पाठ और मुख्य पाठ से अलग फ़ॉन्ट हटा दिए जाते हैं
पंक्ति के अंत में टूटे शब्दहाइफ़न हटाकर दोनों टुकड़े दोबारा जोड़ दिए जाते हैं
अनुच्छेद की सीमाएँइंडेंट नापकर पता लगाया जाता है कि नया अनुच्छेद कहाँ शुरू होता है; पन्ना बदलने पर भी अनुच्छेद टूटता नहीं
OCR की अक्षर-गलतियाँदस्तावेज़ की अपनी शब्दावली को प्रमाण मानकर सुधारी जाती हैं
खंडखंड की शुरुआत में छोड़ी गई जगह से पहचाने जाते हैं; विषय-सूची अपने आप बनती है
कवर और मेटाडेटाकवर की तस्वीर तथा शीर्षक/लेखक की जानकारी PDF से निकाली जाती है

OCR सुधार सुरक्षित कैसे रहता है?

स्कैनिंग सॉफ़्टवेयर अक्षर गड़बड़ा देता है: w को अक्सर vv पढ़ लिया जाता है। लेकिन आँख मूँदकर सुधार करने से असली शब्द बिगड़ जाते हैं — तुर्की शब्द “kuvvet” में सचमुच vv होता है। यह टूल बाहरी शब्दकोश से नहीं, बल्कि दस्तावेज़ की अपनी शब्दावली से सुधार करता है: अगर सही वर्तनी उसी दस्तावेज़ में पहले से बार-बार आती है तो सुधार करता है, वरना शब्द को छूता नहीं। हर बदलाव परिणाम स्क्रीन पर सूचीबद्ध होता है, और आप चाहें तो सुधार पूरी तरह बंद कर सकते हैं।

अक्सर पूछे जाने वाले सवाल

स्कैन की गई PDF और सामान्य PDF में क्या अंतर है?

स्कैन किए दस्तावेज़ में हर पन्ना एक तस्वीर होता है; पाठ OCR से बनता है और तस्वीर के ऊपर अदृश्य रूप से रख दिया जाता है। उस परत में कोई संरचनात्मक जानकारी नहीं होती — न अनुच्छेद, न शीर्षक, न इटैलिक। यह टूल पन्ने की सज्जा से वह संरचना दोबारा निकालता है।

क्या मेरी फ़ाइलें सहेजी जाती हैं?

अपलोड की गई PDF और बनी हुई EPUB अस्थायी स्टोरेज में रहती हैं और 24 घंटे के भीतर अपने आप मिटा दी जाती हैं। फ़ाइलें किसी तीसरे पक्ष के साथ साझा नहीं की जातीं।

कितने आकार तक की फ़ाइल चलेगी?

100 MB तक की PDF फ़ाइलें। लगभग 300 पन्नों का सामान्य दस्तावेज़ कुछ ही सेकंड में बदल जाता है।

बिना टेक्स्ट परत वाली PDF बदली जा सकती है?

हाँ। ऐसी फ़ाइल अपलोड करने पर हम टेक्स्ट पहचान इसी पन्ने पर, आपके अपने कंप्यूटर पर चलाने का विकल्प देते हैं — इसके लिए फ़ाइल कहीं नहीं भेजी जाती। पहली बार भाषा डेटा डाउनलोड होता है और लंबे दस्तावेज़ों में कुछ मिनट लग सकते हैं।

अपलोड की गई फ़ाइलों के लिए कौन ज़िम्मेदार है?

अपलोड की गई फ़ाइलों और रूपांतरण की ज़िम्मेदारी पूरी तरह उपयोगकर्ता की है। कृपया केवल वही फ़ाइलें अपलोड करें जिन पर काम करने का अधिकार आपके पास है।

विज्ञापन
विज्ञापन
विज्ञापन