طرح پژوهشی «بهینهسازی یک الگوریتم نویسهخوان نوری برای پایاننامهها و رسالههای فارسی» به پایان رسید
طرح پژوهشی دکتر آزاده فخرزاده با نام «بهینهسازی یک الگوریتم نویسهخوان نوری برای پایاننامهها و رسالههای فارسی» به پایان رسید.
به گزارش «روابط عمومی پژوهشگاه علوم و فناوری اطلاعات ایران» طرح پژوهشی «بهینهسازی یک الگوریتم نویسهخوان نوری برای پایاننامهها و رسالههای فارسی» توسط دکتر آزاده فخرزاده، استادیار پژوهشکده فناوری اطلاعات به پایان رسید.
در این تحقیق روش ترکیبی مبتنی بر شبکههای پیچشی و شبکههای بازگشتی، برای نویسهخوانی نوری اسناد علمی چاپی فارسی در پایگاه اطلاعاتی گنج معرفی شده است. در این روش ابتدا حروف تشخیص داده میشود و با استفاده از لایه رونویسی کلمات تشخیص داده میشود. در مرحله اول، از شبکههای پیچشی (CNN) برای استخراج ویژگیهای تصویر استفاده شده است. شبکههای پیچشی به دلیل تواناییشان در تشخیص الگوهای محلی و ویژگیهای سطح پایین مانند لبهها و بافتها، به عنوان لایههای اولیه شبکه انتخاب شدهاند. پس از استخراج ویژگیها، از یک شبکه عصبی برگشتپذیر از نوع LSTM برای تشخیص توالی کاراکترها استفاده شده است. و در نهایت، از یک لایه رونویسی توالی برای تبدیل خروجی LSTM به توالی کاراکترهای تشخیص داده شده، استفاده شده است. برای آموزش مدل یک مجموعه داده بر اساس متون کتابهای فارسی ایجاد شده است. این مجموعه داده شامل دو میلیون خط با پنج فونت متفاوت است. خروجی مدل بر روی یک نمونه داده از پایاننامههای موجود در گنج بررسی شده است. نتایج نشان داده روش معرفی شده، با دقت هشتاد درصد عملکرد قابل قبولی در تشخیص درست کلمات و حروف دارد.
