نمایهسازی یکی از ابزارهای تسهیلکننده بازیابی اطلاعات و سرویسهای اطلاعرسانی است. این موضوع از این جهت مورد اهمیت است که هم جامعیت و هم مانعیت را در دسترسی به مدارک بالا میبرد. به دلیل زمانبربودن فرایندهای نمایهسازی و وابستگی شدید به انسان این ابزار هنوز نتوانسته است قابلیتهای خود را در حوزه بازیابی اطلاعات گسترش داده و فراگیر شود. از اینرو سالهاست مطالعه بر روی کاهش وابستگی و یا بینیازکردن این فرایند از انسان شروع شده و فعالیتهای زیاد برای عملیاتیکردن آن صورت گرفته است. این حوزه با نام نمایهسازی ماشینی و یا خودکار شناخته میشود. متاسفانه در کشور ما هنوز فعالیتهای قابل اتکایی در حوزه مذکور صورت نگرفته و میتوان گفت از حوزههای مغفول در رشتههای زبانشناسی، کتابداری و اطلاعرسانی است. با توجه به سابقه پژوهشگاه علوم و فناوری اطلاعات ایران در زمینههای مطالعاتی و اجرایی زبانشناسی رایانهای شاید بتوان گفت یکی از آمادهترین بسترها برای پایهریزی و توسعه علمی و عملیاتی نمایهساز ماشینی برای زبان فارسی باشد. در همین راستا مطالعه حاضر به دنبال بررسی و شناخت جنبههای علمی و اجرایی این سیستم و بررسی نیازمندیهای زبان فارسی و نیازمندیهای اجرایی نمودن این پروژه در پژوهشگاه علوم و فناوری اطلاعات است. گزارش حاضر نتیجه مطالعات در این زمینه و مصاحبه با خبرگان حوزههای زبانشناسی و کتابداری و مشاوره متخصصان حوزه مهندسی نرمافزار میباشد. در این گزارش به رابطه بین نمایهسازی و بازیابی اطلاعاتی (جستوجو)، مباحث نظری و سیر تحول نمایهسازی ماشینی از دیدگاه تئوریک، نمایهسازی ماشینی به صورت عملیاتی و از نگاه فرایندی، پروژههای موفق انجام شده در دنیا و برای زبانهای مختلف و نیازمندیهای نمایهساز ماشینی در زبان فارسی پرداخته شده است. سپس اجزای یک نمایهساز زبان فارسی تشریح گردیده و مدل مفهومی نمایهساز ماشینی به صورت دقیق ترسیم شده و روابط بین اجزا، جزئیات زیر سیستمها و مدل منطقی اولیه سیستم طراحی شده است. در انتها نیازمندیهای توسعه نمایهساز ماشینی برای پژوهشگاه بحث شده و وضعیت پروژههایی که در حال حاضر انجام شده و یا تجربیاتی که وجود دارد و میتوانند در اجرای این پروژه مفید باشد مورد توجه قرار گرفته است.
جلالیمنش، عمار. 1389. طراحی مدل مفهومی یکپارچه نمایهسازی ماشینی منابع فارسی. تهران: پژوهشگاه اطلاعات و مدارک علمی ایران.
