طرح پژوهشی «بهینه‌سازی یک الگوریتم نویسه‌خوان نوری برای پایان‌نامه‌ها و رساله‌های فارسی» به پایان رسید

طرح پژوهشی «بهینه‌سازی یک الگوریتم نویسه‌خوان نوری برای پایان‌نامه‌ها و رساله‌های فارسی» به پایان رسید

طرح پژوهشی دکتر آزاده فخرزاده با نام «بهینه‌سازی یک الگوریتم نویسه‌خوان نوری برای پایان‌نامه‌ها و رساله‌های فارسی» به پایان رسید.

طرح پژوهشی «بهینه‌سازی یک الگوریتم نویسه‌خوان نوری برای پایان‌نامه‌ها و رساله‌های فارسی» به پایان رسید

به گزارش «روابط‌ عمومی پژوهشگاه علوم و فناوری اطلاعات ایران» طرح پژوهشی «بهینه‌سازی یک الگوریتم نویسه‌خوان نوری برای پایان‌نامه‌ها و رساله‌های فارسی» توسط دکتر آزاده فخرزاده، استادیار پژوهشکده فناوری اطلاعات به پایان رسید.

در این تحقیق روش ترکیبی مبتنی بر شبکه‌های پیچشی و شبکه‌های بازگشتی، برای نویسه‌خوانی نوری اسناد علمی چاپی فارسی در پایگاه اطلاعاتی گنج معرفی شده است. در این روش ابتدا حروف تشخیص داده می‌شود و با استفاده از لایه رونویسی کلمات تشخیص داده می‌شود. در مرحله اول، از شبکه‌های پیچشی (CNN) برای استخراج ویژگی‌های تصویر استفاده شده است. شبکه‌های پیچشی به دلیل توانایی‌شان در تشخیص الگوهای محلی و ویژگی‌های سطح پایین مانند لبه‌ها و بافت‌ها، به عنوان لایه‌های اولیه شبکه انتخاب شده‌اند. پس از استخراج ویژگی‌ها، از یک شبکه عصبی برگشت‌پذیر از نوع LSTM برای تشخیص توالی کاراکترها استفاده شده است. و در نهایت، از یک لایه رونویسی توالی برای تبدیل خروجی LSTM به توالی کاراکترهای تشخیص داده شده، استفاده شده است. برای آموزش مدل یک مجموعه داده بر اساس متون کتاب‌های فارسی ایجاد شده است. این مجموعه داده شامل دو میلیون خط با پنج فونت متفاوت است. خروجی مدل بر روی یک نمونه داده از پایان‌نامه‌های موجود در گنج بررسی شده است. نتایج نشان داده روش معرفی شده، با دقت هشتاد درصد عملکرد قابل قبولی در تشخیص درست کلمات و حروف دارد.

شماره :
6155
آخرین به روزرسانی :
شنبه, 15 فروردین 1405 - 12:16
X
Chat Icon