हर PDF में टेक्स्ट नहीं होता
Word से निर्यात की गई PDF में टेक्स्ट होता है। स्कैनर से बनी PDF में टेक्स्ट की तस्वीरें होती हैं। एक साधारण रीडिंग ऐप के लिए दूसरी वाली ख़ामोश है — पढ़ने को कुछ नहीं। पुराने कोर्स रीडर, संग्रहीत रिपोर्ट, लाइब्रेरी स्कैन, खींचे गए अनुबंध: जिन PDF को लोगों को सचमुच पढ़ना होता है उनका बड़ा हिस्सा इसी श्रेणी में आता है।
OCR, लोकल
VocaRead स्कैन किए गए पन्नों को Apple Vision OCR से, आपके डिवाइस पर पहचानता है। पन्ने कभी आपके iPhone से बाहर नहीं जाते: कोई अपलोड नहीं, कोई क्लाउड सेवा नहीं, कोई खाता नहीं। काम के दस्तावेज़ के लिए यह मायने रखता है, और इसका मतलब है कि OCR एयरप्लेन मोड में भी काम करता है। पहचान इम्पोर्ट के दौरान पन्ना-दर-पन्ना चलती है, और नतीजा आपकी लाइब्रेरी में एक सामान्य किताब है, जिसमें हाइलाइटिंग आवाज़ के साथ चलती है।
2.6 और 3.0 में क्या बेहतर हुआ
PDF को अच्छी तरह पढ़ना ज़्यादातर ग़लत चीज़ों को न पढ़ने के बारे में है। हाल के संस्करणों ने एक्सट्रैक्शन को काफ़ी समझदार बनाया है:
- जटिल लेआउट। दो-कॉलम वाले पेपर कॉलम-दर-कॉलम पढ़े जाते हैं, बीच के अंतराल को पार करते हुए पंक्ति-दर-पंक्ति नहीं।
- हेडर, फ़ुटर, पेज नंबर पहचाने जाते हैं और छोड़ दिए जाते हैं, हर पन्ने पर पढ़े नहीं जाते।
- अध्याय पहचान PDF में शीर्षक ढूँढकर उन्हें अध्याय सूची में बदल देती है, ताकि आप EPUB की तरह अध्याय-दर-अध्याय जा सकें — ऐसा गद्य खोए बिना जो सिर्फ़ शीर्षक जैसा दिखता है।
- हाइफ़नेशन और लिगेचर बोलने से पहले ठीक किए जाते हैं: "under-standing" बन जाता है "understanding", "fi" बन जाता है "fi"।
- भूमिका और प्रस्तावना अब पहचानी जाती हैं, इसलिए प्लेबैक असली शुरुआत से शुरू होता है।
स्कैन इम्पोर्ट कैसे करें
- लाइब्रेरी में + टैप करें और Files से PDF चुनें, या Mail, Safari या किसी स्कैनिंग ऐप से शेयर › VocaRead का उपयोग करें।
- VocaRead पहचान लेता है कि पन्ने तस्वीरें हैं और OCR चलाता है। एक प्रगति संकेतक पहचाने जा रहे पन्ने दिखाता है; 300 पन्नों का स्कैन हाल के iPhone पर कुछ मिनट लेता है।
- एक आवाज़ चुनें और प्ले दबाएँ। बाक़ी सब — गति, स्लीप टाइमर, बुकमार्क — किसी भी किताब की तरह काम करता है।
बेहतर नतीजे पाना
- सीधा और अच्छी रोशनी में स्कैन करें। iPhone का बिल्ट-इन डॉक्यूमेंट स्कैनर (Notes या Files) बेहतरीन इनपुट देता है।
- जब चुन सकें तो 300 dpi रखें। कम रिज़ॉल्यूशन वाले स्कैन का छोटा टेक्स्ट वहीं है जहाँ OCR की ग़लतियाँ जमा होती हैं।
- नाम एक बार ठीक करें। अगर कोई बार-बार आने वाला नाम ग़लत पढ़ा या बोला जाता है, तो उच्चारण नियम जोड़ें और वह पूरी किताब पर लागू होगा।
- हाइलाइट्स के साथ जोड़ें। सुनते समय अंश चिह्नित करें और अपने नोट्स के लिए Markdown में निर्यात करें।
सामान्य, टेक्स्ट-आधारित PDF के लिए देखें किसी भी PDF को ऑडियोबुक में कैसे बदलें। स्कैन के उस ढेर पर आज़माने के लिए तैयार हैं? VocaRead डाउनलोड करें — हर दस्तावेज़ में 90 मिनट का मुफ़्त सुनना।