আরবি OCR

● আপনার ব্রাউজারে 100%: কিছুই আপলোড করা হয় না

Loading…

একটি চিত্র থেকে আরবি স্ক্রিপ্ট পড়ুন, ডান থেকে বাম পড়ার ক্রমটি আউটপুটে বিপরীত হওয়ার পরিবর্তে সংরক্ষণ করা হয়েছে। আরবি অক্ষরগুলি একটি শব্দে তাদের অবস্থানের উপর নির্ভর করে আকার পরিবর্তন করে, যা স্ক্রিপ্টটিকে OCR জন্য কঠিন করে তোলে এবং এই প্যাকটি কীসের জন্য প্রশিক্ষিত। একই মডেলে ফারসি, উর্দু, উইঘুর, পশতু, কুর্দি, সিন্ধি এবং বেলুচি লেখা রয়েছে।

যেভাবে কাজ করে

  1. একটি চিত্র ফেলে দিন বা PDF। পাঠ্য সনাক্তকরণ তৎক্ষণাৎ চলে।
  2. আপনার ভাষার প্যাকটি চয়ন করুন (একবার ডাউনলোড করা হয়েছে, 8-17 MB) এবং পাঠ্য পড়ুন টিপুন।
  3. লাইনগুলি অনুলিপি করুন, বা .txt / .json ডাউনলোড করুন। পিডিএফগুলি কভার করার জন্য কভার পড়া হয়।

সচরাচর জিজ্ঞাসা

আউটপুটে পাঠ্যটি কি ডান থেকে বাম?
হ্যাঁ। পড়ার ক্রমটি অক্ষরগুলি অনুমান করার চেয়ে ভাষা প্যাক থেকে আসে, তাই একটি আরবি লাইনের ভিতরে ল্যাটিন শব্দগুলি ফ্লিপ করার পরিবর্তে একা ছেড়ে দেওয়া হয়। অনুসন্ধানযোগ্য-PDF রফতানি একই ক্রম লেখে।
আমার ফাইল কি আপলোড হবে?
না। মডেল এবং সমস্ত প্রক্রিয়াকরণ আপনার নিজের ডিভাইসে আপনার ব্রাউজারের ভিতরে চলে। আপনি নিজেই এটি যাচাই করতে পারেন: আপনার ব্রাউজারের DevToolsখুলুন, নেটওয়ার্ক ট্যাবটি দেখুন এবং একটি ফাইল প্রক্রিয়া করুন: কোনও আপলোড নেই। প্রথম পরিদর্শনের পরে বেশিরভাগ সরঞ্জামগুলি সম্পূর্ণ অফলাইনে কাজ করে।
কোন ভাষা সমর্থিত?
ল্যাটিন, সিরিলিক, আরবি, দেবনাগরী, CJK, গ্রীক, থাই, তামিল এবং তেলুগু লিপি জুড়ে 106 টি ভাষা। বাংলা একটি বড় ব্যবধান, যেহেতু এটির জন্য এখনও কোনও ভি 5 মডেল বিদ্যমান নেই, এবং পিকার অনুমান করার পরিবর্তে এটি বলে।
এটি কতটা সঠিক?
পরিষ্কার ডকুমেন্ট পাঠ্যে, পরিমাপ করা অক্ষর ত্রুটির হার 2% এর নিচে থাকে এবং প্রতিটি লাইনে একটি আত্মবিশ্বাস স্কোর রয়েছে যাতে আপনি কোনটি পরীক্ষা করতে চান তা দেখতে পারেন। হাতের লেখা এবং স্বল্প-রেজোলিউশনের ফটোগুলি আরও খারাপ পড়বে।
এটি কি স্ক্যান করা পিডিএফ পড়ে?
হ্যাঁ। ডিজিটাল পিডিএফগুলি তাদের নিজস্ব পাঠ্য স্তর থেকে পড়া হয়, সঠিক অবস্থানে সঠিক অক্ষর সহ। স্ক্যান করা পৃষ্ঠাগুলি সনাক্তকরণ এবং স্বীকৃতির মধ্য দিয়ে যায় এবং মিশ্র নথিগুলি উভয়ই ব্যবহার করে।

সম্পর্কিত টুল