फोटो या स्कैन से देवनागरी पढ़ें: शिरोरेखा हेडलाइन बार जो एक शब्द में अक्षरों को जोड़ती है, और संयुक्त समूह जहां व्यंजन एक ही ग्लिफ़ में जुड़ते हैं, वे हैं जिन पर इस पैक को प्रशिक्षित किया जाता है। इसमें हिंदी, मराठी, नेपाली, संस्कृत, भोजपुरी, मैथिली और कोंकणी के साथ-साथ अंग्रेजी भी शामिल है।
यह कैसे काम करता है
- कोई इमेज या PDFछोड़ें. टेक्स्ट डिटेक्शन तुरंत चलता है।
- अपना भाषा पैक चुनें (एक बार डाउनलोड किया गया, 8-17 एमबी) और पाठ पढ़ें दबाएं.
- पंक्तियों को कॉपी करें, या .txt/.json डाउनलोड करें। पीडीएफ को कवर करने के लिए कवर पढ़ा जाता है।
अक्सर पूछे जाने वाले प्रश्न
- क्या यह कंजंक्ट और मात्रा को सही ढंग से संभालता है?
- देवनागरी पैक इसी के लिए मौजूद है - लैटिन पाठ पर प्रशिक्षित एक सामान्य मॉडल हेडलाइन बार को एक रेखांकन के रूप में पढ़ता है और संयुग्मों को गलत व्यंजन में विभाजित करता है। आउटपुट यूनिकोड देवनागरी है जिसे आप कहीं भी पेस्ट कर सकते हैं।
- क्या मेरी फ़ाइल अपलोड हो जाती है?
- नहीं। मॉडल और सभी प्रसंस्करण आपके अपने डिवाइस पर आपके ब्राउज़र के अंदर चलते हैं। आप इसे स्वयं सत्यापित कर सकते हैं: अपने ब्राउज़र का DevToolsखोलें, नेटवर्क टैब देखें, और एक फ़ाइल संसाधित करें: कोई अपलोड नहीं हैं। पहली विज़िट के बाद अधिकांश टूल पूरी तरह से ऑफ़लाइन भी काम करते हैं।
- कौन सी भाषाएँ समर्थित हैं?
- लैटिन, सिरिलिक, अरबी, देवनागरी, CJK, ग्रीक, थाई, तमिल और तेलुगु लिपियों में 106 भाषाएं। बंगाली एक बड़ा अंतर है, क्योंकि इसके लिए अभी तक कोई v5 मॉडल मौजूद नहीं है, और बीनने वाला अनुमान लगाने के बजाय ऐसा कहता है।
- यह कितना सटीक है?
- स्वच्छ दस्तावेज़ पाठ पर, मापी गई वर्ण त्रुटि दर 2% से कम है, और प्रत्येक पंक्ति में एक आत्मविश्वास स्कोर होता है ताकि आप देख सकें कि किसे जांचना है। लिखावट और कम-रिज़ॉल्यूशन वाली तस्वीरें बदतर पढ़ेंगी।
- क्या यह स्कैन की गई पीडीएफ पढ़ता है?
- हाँ। डिजिटल PDF को उनकी अपनी टेक्स्ट लेयर से पढ़ा जाता है, जिसमें सटीक स्थान पर सटीक वर्ण होते हैं। स्कैन किए गए पृष्ठ पहचान और पहचान से गुजरते हैं, और मिश्रित दस्तावेज़ दोनों का उपयोग करते हैं।