थाई OCR

● आपके ब्राउज़र में 100%: कुछ भी अपलोड नहीं किया गया है

Loading…

एक छवि से थाई पढ़ें। थाई शब्दों के बीच रिक्त स्थान के बिना लिखा जाता है और व्यंजन रेखा के ऊपर और नीचे स्वर और स्वर के निशान ढेर होते हैं, इसलिए थाई की एक पंक्ति शब्दों में विभाजित होने के बजाय निरंतर लिपि के रूप में वापस आती है - यह कि स्क्रिप्ट सामान्य रूप से व्यवहार करती है, न कि पहचानने वाला विफल हो रहा है। उसी पृष्ठ पर अंग्रेजी भी पढ़ी जाती है।

यह कैसे काम करता है

  1. कोई इमेज या PDFछोड़ें. टेक्स्ट डिटेक्शन तुरंत चलता है।
  2. अपना भाषा पैक चुनें (एक बार डाउनलोड किया गया, 8-17 एमबी) और पाठ पढ़ें दबाएं.
  3. पंक्तियों को कॉपी करें, या .txt/.json डाउनलोड करें। पीडीएफ को कवर करने के लिए कवर पढ़ा जाता है।

अक्सर पूछे जाने वाले प्रश्न

शब्दों के बीच कोई अंतर क्यों नहीं है?
थाई शब्दों के बीच रिक्त स्थान नहीं लिखता है; रिक्त स्थान इसके बजाय खंडों के सिरों को चिह्नित करते हैं। थाई पंक्ति को शब्दों में विभाजित करना इसे पढ़ने से एक अलग समस्या है, और इस पर अनुमान लगाने से ऐसे ब्रेक आएंगे जो दस्तावेज़ में नहीं हैं।
क्या मेरी फ़ाइल अपलोड हो जाती है?
नहीं। मॉडल और सभी प्रसंस्करण आपके अपने डिवाइस पर आपके ब्राउज़र के अंदर चलते हैं। आप इसे स्वयं सत्यापित कर सकते हैं: अपने ब्राउज़र का DevToolsखोलें, नेटवर्क टैब देखें, और एक फ़ाइल संसाधित करें: कोई अपलोड नहीं हैं। पहली विज़िट के बाद अधिकांश टूल पूरी तरह से ऑफ़लाइन भी काम करते हैं।
कौन सी भाषाएँ समर्थित हैं?
लैटिन, सिरिलिक, अरबी, देवनागरी, CJK, ग्रीक, थाई, तमिल और तेलुगु लिपियों में 106 भाषाएं। बंगाली एक बड़ा अंतर है, क्योंकि इसके लिए अभी तक कोई v5 मॉडल मौजूद नहीं है, और बीनने वाला अनुमान लगाने के बजाय ऐसा कहता है।
यह कितना सटीक है?
स्वच्छ दस्तावेज़ पाठ पर, मापी गई वर्ण त्रुटि दर 2% से कम है, और प्रत्येक पंक्ति में एक आत्मविश्वास स्कोर होता है ताकि आप देख सकें कि किसे जांचना है। लिखावट और कम-रिज़ॉल्यूशन वाली तस्वीरें बदतर पढ़ेंगी।
क्या यह स्कैन की गई पीडीएफ पढ़ता है?
हाँ। डिजिटल PDF को उनकी अपनी टेक्स्ट लेयर से पढ़ा जाता है, जिसमें सटीक स्थान पर सटीक वर्ण होते हैं। स्कैन किए गए पृष्ठ पहचान और पहचान से गुजरते हैं, और मिश्रित दस्तावेज़ दोनों का उपयोग करते हैं।

मिलते-जुलते टूल