بازیابی اطلاعات به معنای یافتن محتوایی با طبیعت غیرساختیافته (معمولا متن) از مجموعههایی به منظور برآورده ساختن نیاز(های) اطلاعاتی کاربران است. با بهرهگیری از روشهای بازیابی اطلاعات موجود در ادبیات پلتفرمهای متنباز متعددی طراحی شدهاند. کتابخانه آپاچی لوسن و موتور جستوجوی آپاچی سولر از این نوع پلتفرمها هستند. سامانه گنج نیز به منظور جستوجو در اسناد و مدارک ذخیره شده در پایگاه داده خود، از این کتابخانه و موتور جستوجو به عنوان هسته اصلی فرآیند بازیابی اطلاعات استفاده میکند. علیرغم کاربردهای گسترده، سولر دارای کاستیهایی بوده، تاکنون نیز هیچگونه پژوهشی در زمینه شناسایی و واکاوی این کتابخانه و موتور جستوجو در پژوهشگاه انجام نشده و تنها عملکرد رابط کاربری آن و مشکلات موجود بررسی شده است. لذا علیرغم ضرورت بررسی کارایی رابط کاربری گنج، تازمانی که هسته اصلی آن (خصوصا با تمرکز بر زبان فارسی) بررسی و اصلاح نشود نمیتوان انتظار داشت عملکرد سامانه مطلوب باشد. لذا ضروری است تا با بررسی محدودیتها و مشکلات موجود در روشهای مورد استفاده در موتور جستوجوی آپاچی سولر (از منظر بازیابی اطلاعات) دیدگاهی کلان نسبت به آن در پژوهشگاه ایجاد شده تا از این طریق بتوان پیشنهادهایی به منظور ارتقا عملکرد هسته اصلی فرآیند بازیابی اطلاعات سامانه گنج ارائه داد. بر این اساس، طرح پژوهشی با عنوان «بررسی موتور جستوجوی گنج به منظور بهبود بازیابی اطلاعات در زبان فارسی» پیشنهاد شد. در این طرح دانش فنی درمورد این موتور جستوجو و روشهای مورد استفاده آن کسب شده و راهکارهایی به منظور ارتقای نتایج بازیابی در زبان فارسی و در سامانه گنج ارائه شد. راهکارهای پیشنهاد شده در قالب دو دسته راهکارهای نیازمند پژوهش و راهکارهای فنی و عملیاتی دستهبندی شدند.
زرینبال ماسوله، مرضیه. 1398. بررسی موتور جستوجوی گنج به منظور بهبود بازیابی اطلاعات در زبان فارسی. تهران: پژوهشگاه علوم و فناوری اطلاعات ایران.
