अरबी OCR

● आपके ब्राउज़र में 100%: कुछ भी अपलोड नहीं किया गया है

Loading…

एक छवि से अरबी लिपि पढ़ें, दाएं से बाएं पढ़ने के क्रम को उलटने के बजाय आउटपुट में संरक्षित किया जाता है। अरबी अक्षर एक शब्द में अपनी स्थिति के आधार पर आकार बदलते हैं, जो कि स्क्रिप्ट को OCR के लिए कठिन बनाता है और इस पैक को किसके लिए प्रशिक्षित किया जाता है। एक ही मॉडल फारसी, उर्दू, उइगर, पश्तो, कुर्द, सिंधी और बलूची पढ़ता है।

यह कैसे काम करता है

  1. कोई इमेज या PDFछोड़ें. टेक्स्ट डिटेक्शन तुरंत चलता है।
  2. अपना भाषा पैक चुनें (एक बार डाउनलोड किया गया, 8-17 एमबी) और पाठ पढ़ें दबाएं.
  3. पंक्तियों को कॉपी करें, या .txt/.json डाउनलोड करें। पीडीएफ को कवर करने के लिए कवर पढ़ा जाता है।

अक्सर पूछे जाने वाले प्रश्न

क्या आउटपुट में पाठ दाएं-से-बाएं है?
हाँ। पढ़ने का क्रम वर्णों पर अनुमान लगाने के बजाय भाषा पैक से आता है, इसलिए अरबी लाइन के अंदर लैटिन शब्दों को फ़्लिप करने के बजाय अकेला छोड़ दिया जाता है। खोज योग्य-PDF निर्यात एक ही क्रम लिखता है।
क्या मेरी फ़ाइल अपलोड हो जाती है?
नहीं। मॉडल और सभी प्रसंस्करण आपके अपने डिवाइस पर आपके ब्राउज़र के अंदर चलते हैं। आप इसे स्वयं सत्यापित कर सकते हैं: अपने ब्राउज़र का DevToolsखोलें, नेटवर्क टैब देखें, और एक फ़ाइल संसाधित करें: कोई अपलोड नहीं हैं। पहली विज़िट के बाद अधिकांश टूल पूरी तरह से ऑफ़लाइन भी काम करते हैं।
कौन सी भाषाएँ समर्थित हैं?
लैटिन, सिरिलिक, अरबी, देवनागरी, CJK, ग्रीक, थाई, तमिल और तेलुगु लिपियों में 106 भाषाएं। बंगाली एक बड़ा अंतर है, क्योंकि इसके लिए अभी तक कोई v5 मॉडल मौजूद नहीं है, और बीनने वाला अनुमान लगाने के बजाय ऐसा कहता है।
यह कितना सटीक है?
स्वच्छ दस्तावेज़ पाठ पर, मापी गई वर्ण त्रुटि दर 2% से कम है, और प्रत्येक पंक्ति में एक आत्मविश्वास स्कोर होता है ताकि आप देख सकें कि किसे जांचना है। लिखावट और कम-रिज़ॉल्यूशन वाली तस्वीरें बदतर पढ़ेंगी।
क्या यह स्कैन की गई पीडीएफ पढ़ता है?
हाँ। डिजिटल PDF को उनकी अपनी टेक्स्ट लेयर से पढ़ा जाता है, जिसमें सटीक स्थान पर सटीक वर्ण होते हैं। स्कैन किए गए पृष्ठ पहचान और पहचान से गुजरते हैं, और मिश्रित दस्तावेज़ दोनों का उपयोग करते हैं।

मिलते-जुलते टूल