دوباره درباره ocr فارسی – محمدی و هوشیار
خب؛
تصویر یک نامه 2 صفحه ای (متن فارسی) را به هوشیار دادم برای ocr . یک صفحه را نتونست خروجی بده و پاسخ داد:
علتش این است که موتور OCR که در آن محیط استفاده کردم، روی صفحه دوم نتوانسته متن قابل قبولی استخراج کند و در نتیجه فایل خروجی عملاً فقط شامل متن صفحه اول شده است.
یادم افتاد که محمدی (اینجا و اینجا) قبلا یک موتور ocr فارسی برای شرکت هدی سیستم نوشته بود که محشر بود و اینجوری که خودش میگفت بر خلاف ابزارهای موجود تا آن زمان؛ در تبدیل ocr فارسی بسیار موفق عمل میکرد.
پیشنهاد میکنم محمدی با هوشیار وارد تعامل شود تا با کمک محمدی؛ هوشیار بتواند در تبدیل ocr فارسی موفق تر عمل کند.

