तमिल OCR

● आपके ब्राउज़र में 100%: कुछ भी अपलोड नहीं किया गया है

Loading…

एक छवि से तमिल लिपि पढ़ें। तमिल स्वरों को व्यंजन के चारों ओर जुड़े चिह्नों के रूप में लिखता है - पहले, बाद, ऊपर या दोनों तरफ एक साथ - इसलिए पहचानकर्ता को एक क्लस्टर को बाएं से दाएं के बजाय एक इकाई के रूप में पढ़ना पड़ता है। उसी पेज पर अंग्रेजी को उसी 7.9 एमबी पैक द्वारा पढ़ा जाता है, जो एक बार डाउनलोड होता है और फिर ऑफलाइन काम करता है।

यह कैसे काम करता है

  1. कोई इमेज या PDFछोड़ें. टेक्स्ट डिटेक्शन तुरंत चलता है।
  2. अपना भाषा पैक चुनें (एक बार डाउनलोड किया गया, 8-17 एमबी) और पाठ पढ़ें दबाएं.
  3. पंक्तियों को कॉपी करें, या .txt/.json डाउनलोड करें। पीडीएफ को कवर करने के लिए कवर पढ़ा जाता है।

अक्सर पूछे जाने वाले प्रश्न

यह कौन से तमिल स्रोतों को सबसे अच्छा पढ़ता है?
मुद्रित पाठ - किताबें, साइनेज, फॉर्म, स्क्रीनशॉट - वह है जिस पर इसे प्रशिक्षित किया जाता है और जहां यह सबसे मजबूत है। हस्तलिखित तमिल उस प्रशिक्षण का हिस्सा नहीं है। हर पंक्ति में एक आत्मविश्वास स्कोर होता है, इसलिए कमजोर रीडिंग साइलेंट के बजाय दिखाई देती है।
क्या मेरी फ़ाइल अपलोड हो जाती है?
नहीं। मॉडल और सभी प्रसंस्करण आपके अपने डिवाइस पर आपके ब्राउज़र के अंदर चलते हैं। आप इसे स्वयं सत्यापित कर सकते हैं: अपने ब्राउज़र का DevToolsखोलें, नेटवर्क टैब देखें, और एक फ़ाइल संसाधित करें: कोई अपलोड नहीं हैं। पहली विज़िट के बाद अधिकांश टूल पूरी तरह से ऑफ़लाइन भी काम करते हैं।
कौन सी भाषाएँ समर्थित हैं?
लैटिन, सिरिलिक, अरबी, देवनागरी, CJK, ग्रीक, थाई, तमिल और तेलुगु लिपियों में 106 भाषाएं। बंगाली एक बड़ा अंतर है, क्योंकि इसके लिए अभी तक कोई v5 मॉडल मौजूद नहीं है, और बीनने वाला अनुमान लगाने के बजाय ऐसा कहता है।
यह कितना सटीक है?
स्वच्छ दस्तावेज़ पाठ पर, मापी गई वर्ण त्रुटि दर 2% से कम है, और प्रत्येक पंक्ति में एक आत्मविश्वास स्कोर होता है ताकि आप देख सकें कि किसे जांचना है। लिखावट और कम-रिज़ॉल्यूशन वाली तस्वीरें बदतर पढ़ेंगी।
क्या यह स्कैन की गई पीडीएफ पढ़ता है?
हाँ। डिजिटल PDF को उनकी अपनी टेक्स्ट लेयर से पढ़ा जाता है, जिसमें सटीक स्थान पर सटीक वर्ण होते हैं। स्कैन किए गए पृष्ठ पहचान और पहचान से गुजरते हैं, और मिश्रित दस्तावेज़ दोनों का उपयोग करते हैं।

मिलते-जुलते टूल