جستجوي پيشرفته | کتابخانه مجازی الفبا

جستجوي پيشرفته | کتابخانه مجازی الفبا

کتابخانه مجازی الفبا،تولید و بازنشر کتب، مقالات، پایان نامه ها و نشریات علمی و تخصصی با موضوع کلام و عقاید اسلامی کتابخانه مجازی الفبا،تولید و بازنشر کتب، مقالات، پایان نامه ها و نشریات علمی و تخصصی با موضوع کلام و عقاید اسلامی

فارسی  |   العربیه  |   English  
telegram

در تلگرام به ما بپیوندید

public

کتابخانه مجازی الفبا
کتابخانه مجازی الفبا
header
headers
پایگاه جامع و تخصصی کلام و عقاید و اندیشه دینی
جستجو بر اساس ... همه موارد عنوان موضوع پدید آور جستجو در متن
: جستجو در الفبا در گوگل
مرتب سازی بر اساس و به صورت وتعداد نمایش فرارداده در صفحه باشد جستجو
  • تعداد رکورد ها : 21
فیلتر صفحات وب با استفاده از آنتولوژی و ابزارهای وب معنایی
نویسنده:
مرتضی جادریان
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
در سال‌های اخیر، تکنیک‌های فیلتر محتوایی دانش‌محور مبتنی‌بر پایگاه دانش و آنتولوژی به‌ روش‌هایی کارا و قابل‌قبول برای فیلتر اطلاعات تبدیل شده‌اند. در این تحقیق از ساختار آنتولوژی و پایگاه‌دانش‌های ویکی‌پدیا، وردنت و BNC برای عمل فیلتر اسناد، بهبود نمایش اولویت‌های کاربری و محتوای اسناد و محاسبه شباهت معنایی استفاده می‌شود. همچنین سامان‌دهی علایق کاربری و محتوای اسناد در پروفایل‌ها امکان استخراج دانش درباره‌ی علایق احتمالی کاربران و محتوای اسناد را با استفاده از آنتولوژی و پایگاه‌دانش فراهم می‌آورد. این تحقیق روشی نوین و منحصر‌به‌فرد در ساختار ترکیب خبرگان برای فیلتر اسناد ارائه می‌کند و مجموعه‌ای از بهترین و کاراترین روش‌های فیلتر را پیاده‌سازی و با هم یکپارچه می‌کند. ارزیابی سیستم در دو مرحله ارزیابی روش‌های محاسبه شباهت معنایی و روش‌های فیلتر محتوایی با استفاده از مجموعه داده‌های میلر- چارلز و 20Newsgroup انجام می‌شود. نتایج ارزیابی، همبستگی زیاد روش‌های محاسبه‌ی شباهت معنایی میان مفاهیم را با قضاوت بشر نشان می‌دهد. روش‌ مبتنی‌بر ویکی‌پدیا با میزان همبستگی 0.779 نه‌تنها از دیگر روش‌های پیاده‌سازی شده بهتر عمل می‌کند بلکه از روش‌های مشابه و شناخته‌شده‌ای مانند CODC با میزان همبستگی 0.693 و روش ESA با میزان همبستگی 0.58 بهتر عمل می‌کند. به‌علاوه در ارزیابی روش‌های فیلتر دانش‌محور ملاحظه می‌شود که روش مبتنی‌بر آنتولوژی با نرخ صحت و کارآیی98.9 و 98 درصد و روش مبتنی‌بر ویکی‌پدیا با نرخ صحت و کارآیی98.2 و 96 درصد نتایجبهتری نسبت به دیگر روش‌های مشابه و شناخته شده مانند NB-SVM Hybrid دارند. همچنین نتایج ارزیابی روش مبتنی‌بر ساختار ترکیب خبرگانبا نرخ صحت و کارآیی 99.4 و 98.9 درصد نشان می‌دهد کهاین روش نه‌تنها از تک‌تک روش‌های پیاده‌سازی شده کارآیی و صحت بالاتری دارد، بلکه می‌تواند خطاهای عمل فیلتر را تصحیح کند. براساس این نتایج، سیستم پیاده‌سازی شده می‌تواند به‌عنوان رویکرد جدیدی در فیلتر محتوایی و به‌عنوان چارچوبی برای استفاده در کاربردهای فیلتر اطلاعات استفاده شود.
بهینه‌سازی فرآیند جست و جو و نگهداری داده‌های پیوندی وب معنایی
نویسنده:
نغمه سهرابیان
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
برخلاف وب، هدف اصلی وب‏معنایی قابلیت فهم ماشین از اسناد است. توسعه‏ی وب‏معنایی مستلزم توسعه ی داده‏های پیوندی است. داده‏های‏پیوندی اجزای سازنده ی وب‏معنایی هستند که در قالب مدلآر. دی. اف ، منابع‏داده‏ای مختلف وب را به هم مرتبط می کنند. با گذشت زمان تعداد این داده‏ها رو به افزایش است و این امر بازیابی و نگهداری داده‏ها را با مشکل مواجه کرده است. بنابراین نگهداری داده‏های‏پیوندی به نحوی که بازیابی اطلاعات مورد نیاز با صرف کمترین زمان و پیچیدگی انجام شود، نیاز به نگهداری بهینه ی این داده ها را توجیه می کند.معمولاً از جداول‏ رابطه‏ای بزرگ برای نگهداری داده‏های وب‏معنایی استفاده می‏شود. هدف این پژوهش شکستن این جداول رابطه‏ای به جداول کوچک‏تر به‏منظور مدیریت آسان‏تر داده‏های‏پیوندی و دسته‏بندی آن‏هاست. در روش پیشنهادی، این دسته‏بندی براساس نگاشت ساختارهای آنتولوژی مرتبط ‏با داده‏ها به پایگاه‏داده‏ی رابطه‏ای انجام می‏شود. روش‏ پیشنهادی جهت افزایش دقّت داده‏های‏پیوندی از نوعی استنتاج روی داده‏های‏پیوندی بهره می‏گیرد و سرعت بازیابی داده‏های‏پیوندی را نیز از‏ طریق انتخاب ساختارهای ذخیره‏ی مناسب و شاخص‏گذاری افزایش می‏دهد. نتایج حاصل از مقایسه‏ی روش پیشنهادی با روش‏های مطرح ذخیره‏سازی داده‏های آر. دی. اف مانند روش مستقل از الگو، روش مبتنی‏بر الگو و روش هیبرید افزایش سرعت و دقّت داده‏های بازیابی‏شده را نشان می‏دهد و با به‏کارگیری ساختارهای مناسب امکان پاسخ‏گویی به طیف وسیع‏تری از پرس‏وجوها فراهم می‏آید. به‏منظور ارزیابی نتایج از جعبه‏ی‏ اطلاعات در مجموعه‏داده‏ی دی‏بی‏پدیااستفاده شده است.
خلاصه‌سازی خودکار متون فارسی مبتنی بر هستی‌شناسی
نویسنده:
مجید رمضانی
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
با توجه به گسترش روزافزون اطلاعات در دسترس از طریق اینترنت، لزوم استفاده از روش های خلاصه سازی خودکار متن، بیش از پیش احساس می شود. روش هایی که با استخراج مهمترین مطالب موجود در اسناد مانع از مطالعه کامل حجم انبوه از آنها شوند. خلاصه سازی عبارت است از فشرده سازی متن (متون) منبع و تولید یک نسخه کوتاه تر از آن به نحوی که محتوای اطلاعاتی آن حفظ شود. اغلب سیستم های خلاصه ساز با استفاده از روش های سطحی و معیارهای آماری به استخراج مهمترین بخش های متن منبع پرداخته و خلاصه نهایی را شکل می دهند. هدف این پژوهش استفاده از یک روش مبتنی بر پایگاه دانش در فرآیند خلاصه سازی است. در این راستا از پایگاه دانش هستی شناسی فارس نت به منظور دستیابی به مفاهیم موجود در متون و تولید خلاصه آنها استفاده خواهد شد. هستی شناسی یکی از مباحث مربوط به علم فلسفه است که یک ساختار سلسله مراتبی از همه موجودیت های عالم هستی به همراه روابط حاکم بر آنها فراهم می کند. در این پژوهش ابتدا با نگاشت متن مورد خلاصه سازی با پایگاه دانش هستی شناسی، گرافی تحت عنوان گراف موضوعی شکل می گیرد که حامل شمای مفهومی متن منبع است. سپس با استفاده از معیارهای مختلف تعیین اهمیت گرافی، اهمیت نسبی هر یک از گره های گراف ارزیابی می شود. سرانجام از این مقادیر به منظور تعیین اهمیت جملات مختلف موجود در متن منبع و ساخت خلاصه نهایی استفاده خواهد شد. نتایج حاصل از ارزیابی خلاصه های تولید شده، حاکی از برتری روش پیشنهاد شده در این پژوهش نسبت به سیستم های خلاصه ساز موجود است.
پیمانه‌ای‌کردن آنتولوژی در وب معنایی
نویسنده:
مریم جعفری شریف‌آبادی
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
ایده اصلی وب معنایی، ایجاد فراداده‌هایی است که داده را شرح می‌دهند تا کامپیوترها را قادر به پردازش معنی اشیا کنند. هدف از وب معنایی این است که ماشین‌ها نیز همانند انسان‌ها سندها را درک کرده و تفسیر کنند. یکی از مولفه‌های اصلی وب معنایی، آنتولوژی است، که نسبت به سایر مولفه‌ها از قدرت بیان بیشتری برخوردار است. آنتولوژی، مجموعه‌ای از واژگان مشترک را برای محققانی تعریف می‌کند که نیاز به اشتراک‌گذاری اطلاعات در یک دامنه دارند. امروزه استفاده از آنتولوژی در وب افزایش یافته است. بسیاری از آنتولوژی‌های معروف، اندازه بزرگی دارند. اندازه بزرگ این آنتولوژی‌ها باعث کاهش سرعت و کارایی در استفاده‌مجدد، استنتاج، نگهداری و هماهنگی سیستم‌های توزیع‌شده می‌شود. راه‌حل این مساله، پیمانه‌‌ای کردن آنتولوژی می‌باشد. پیمانه‌ای کردن آنتولوژی، بخش مهمی از مهندسی آنتولوژی است که برای کاهش پیچیدگی و اندازه آنتولوژی، یا آن را به کل قطعات تشکیل‌دهنده می‌شکند (تقسیم‌بندی آنتولوژی) و یا اینکه فقط بخش کوچکی از آن را استخراج می‌کند (استخراج پیمانه). هدف از این پژوهش ارائه رهیافتی برای پیمانه‌ای کردن آنتولوژی به پیمانه‌هایی درست، کامل و متصل به هم است، به صورتی که کاربر بتواند بر اساس نیازهای برنامه کاربردی تنظیماتی را در پیمانه‌ای کردن اعمال کند.رهیافت ارائه‌شده در این پژوهش روی تقسیم‌بندی آنتولوژی تمرکز دارد. برای داشتن قطعه‌های کامل، ابتدا یک استنتاج مقدماتی روی آنتولوژی انجام شده و سپس حاصل آن به Pato، که ابزاری برای تقسیم‌بندی است، داده می‌شود. به دلیل انجام استنتاج مقدماتی، نتیجه تقسیم‌بندی، پیمانه‌هایی مرتبط و نیمه‌کامل است. بنابراین، قضایای کامل‌کننده به آن‌ها اضافه می‌شود. سپس پیمانه‌ها توسط زبان آنتولوژی پیمانه‌ای P-DL به هم متصل می‌شوند. به این ترتیب، پیمانه‌های حاصل، پیمانه‌هایی متصل و کامل با اندازه مناسب هستند. هرچند استنتاج روی آنتولوژی‌های بزرگ عملی وقت‌گیر است، اما فقط یکبار صورت می‌گیرد و در عوض مزایای زیادی به همراه دارد که توسط دیگر روش‌ها تامین نمی‌شوند. برای ضمانتِ این ادعا، روش ارائه‌شده و روش‌های قبلی به صورت تئوری و عملی ارزیابی شده و نشان داده می‌شود که این روش باعث می‌شود که آنتولوژی به‌طور متعادلی بخش‌بندی شود و پیمانه‌های حاصل مانند یک آنتولوژی خودشمول، توسط ابزارهای زیادی استفاده شوند.
پیشنهاد یک هستی‌شناسی برای شواهد کسب شده از جرم‌شناسی حافظه به همراه چارچوبی جدید برای بازسازی خودکار حوادث در تجسّس دیجیتال
نویسنده:
مصطفی مردفکری
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
از دیر باز بحث امنیت سیستم‌های رایانه‌ای همراه با فزونی یافتن اقسام آسیب پذیری‌ها و نیز سوءاستفاده مهاجمین از این ضعف‌ها به عنوان یکی از مباحث پر تنش در جوامع علمی مطرح بوده است. می‌توان اقدامات انجام شده در زمینه امنیت رایانه‌ای را به دو دسته کلی تقسیم کرد: پیش از رخداد و پس از رخداد. در زمینه فرایندهای پس از رخداد بیشتر علاقه‌مندیم تا با کسب شواهد دیجیتال از سیستم هدف به شناسایی جرم حادث شده،‌ عامل آن و میزان خرابی متاثر از جرم بپردازیم تا در صورت امکان مهاجم را تشخیص داده، راه نفوذ را سَد کنیم و به جبران مافات بپردازیم. به مجموعه این فرایند، جرم‌شناسی دیجیتال گفته می‌شود. در این میان، منابع متفاوتی همچون دیسک، شبکه و حافظه برای کسب شواهد از سیستم هدف وجود دارند. روش‌های مرسوم به علت مانایی داده‌های روی دیسک بیشتر به کسب شواهد از این منبع می‌پردازند. حال آنکه منابع پر‌ارزشی از اطلاعات به علت نامانایی و یا سختی تحلیل از بررسی باز می‌مانند. در این پژوهش سعی داریم اَهمّ ابزارهایی که تاکنون برای جمع‌آوری و نیز تحلیل شواهد حافظه ارائه شدند را به صورت کلی بررسی کرده و معیاری برای مقایسه و انتخاب آنها توسط متخصصان امنیت ارائه دهیم. به طور کلی به این فرایندهای کسب و تحلیل داده‌های حافظه جرم‌شناسی حافظه گفته می‌شود. درادامه به مُعضلات روش‌های مرسوم در زمینه جرم‌شناسی حافظه خواهیم پرداخت و نشان خواهیم داد که می‌توان با یک هستی‌شناسی پیشنهادی و ارائه استاندارد برای شواهد کسب شده از حافظه به بسیاری از این مسائل پاسخ گفت. در نهایت چارچوب جدیدی را برای بازسازی حوادث رخ داده در طی تجسّس دیجیتال پیشنهاد خواهیم کرد تا جرم‌‌شناسان بتوانند از آن برای عینیت بخشیدن به سیر وقوع حوادث رخ داده بهره ببرند.
نظرکاوی در وب در سطح ویژگی مبتنی ‌بر آنتولوژی
نویسنده:
بشیر میاحی
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
با گسترش رسانه‌های اجتماعی در فضای وب (انجمن‌های وب، شبکه‌های اجتماعی، بلاگ‌‌ها و ...) منابعی غنی و ارزان از نظرات به‌وجود آمده‌اند، مردم و تولیدکنندگان برای بررسی نظرات به این رسانه‌ها روی آورده‌اند. تحلیل نظرها از دو جنبه کاربرد فراوان دارد. برای صاحبان تجارت، گرفتن بازخورد مشتریان از محصول و سرویس می‌تواند بسیار مفید باشد تا براساس آن، تصمیم‌های مناسبی را در محصول و سرویس‌های بعدی خود دخیل کنند. همچنین برای کاربرانی که قصد تهیه محصول را دارند، استفاده از نظر سایرین برای رسیدن به خریدی مطمئن و مطابق با سلایق خود می‌تواند کمک کننده باشد. هدف اصلی این تحقیق ایجاد و پیاده‌سازی سیستم کاوش نظرات در وب و تحلیل این نظرات برای به‌دست آوردن میزان نظرات مثبت و منفی مربوط به هر یک از ویژگی‌های محصول است. هدف نهایی این سیستم، مشخص کردن میزان نظرات مثبت و منفی ویژگی‌های محصول و رتبه‌بندی (Rank) ویژگی‌های محصولات موجود بر اساس بیش‌ترین نظرات مثبت و منفی است تا کاربر از بین محصولات موجود، محصولی که دارای بیش‌ترین نظرات مثبت برای ویژگی‌های دلخواه است را بتواند انتخاب کند. در تحقیق پیش‌رو سعی بر آن داریم با استفاده از آنتولوژی و ابزارهای وب‌معنایی با استفاده از معنای جملات و مفاهیم مستتر در محتویات نتایج بهتری نسبت به روش‌های سنتی به‌دست آوریم. در این تحقیق فرض بر این است که در هر نظر، کاربران به ویژگی‌های مختلفی از موضوع اشاره می‌کنند و در آن نظر ممکن است برخی ویژگی‌ها از نظر کاربر مثبت و برخی دیگر از ویژگی‌ها منفی تلقی شود. با این دید، یک نظر از کاربر را به‌جای آن‌که مطلق مثبت یا منفی قلمداد کرد، مثبت، منفی و خنثی را به هر یک از ویژگی‌هایی که کاربر ذکر می‌کند اعمال می‌کنیم.
به کارگیری رویکرد فازی در تطابق آنتولوژی و ارزیابی کاربردی آن
نویسنده:
الهام علی قارداش
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
هستی شناسی مدلی برای نمایش یک دامنه است و برای استدلال درمورد اشیا و روابط بین آنها در همان دامنه به کار می‌رود. هستی شناسی معمولا شامل مفاهیم، روابط بین مفاهیم، نمونه‌ها و ویژگی‌های مفاهیم است. در سالیان گذشته تعداد هستی شناسی‌های موجود به شدت افزایش یافته است. وجود این سطح از تنوع، مسئله ادغام و استفاده مجدد از اطلاعات را مطرح می‌نماید. اگرچه که با بررسی دقیق‌تر هستی شناسی‌ها می‌بینیم که بسیاری از آنها با یکدیگر دارای همپوشانی هستند، اما استفاده از چهارچوب‌های کاری متفاوت، زبان‌های متنوع، و از همه مهمتر زوایای دید مختلف برای توسعه و ایجاد آنها باعث می‌شود تا کشف این شباهت‌ها و به طور کلی روابط بین مفاهیم مطرح شده در هریک از آنها ساده نباشد. آنچه به عنوان راه حل برای این مشکل مطرح می‌شود، تطابق هستی شناسی است. اصل این کار بر کشف مطابقت‌های بین مفاهیم و روابط آنها در هستی شناسی‌های مختلف و ایجاد نگاشت بین آنها استوار است. در این مطالعه استفاده از استنتاج فازی در کنار هستی شناسی سطح بالای وردنت در تطابق، امکان سنجی شده و نتایج حاکی از این است که استنتاج فازی می‌تواند به عنوان گزینه‌ای برای روش‌های تطابق در نظر گرفته شود.
نمونه‌سازی آنتولوژی با استفاده از وب‌کاوی
نویسنده:
راشین رضازاده
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
وب امروزی اطلاعات را به‌صورت پراکنده و بدون درنظر‌گرفتن معنایشان در وب‌سایت‌های مختلف قرار داده است. اگر شخصی بخواهد به‌دنبال کالا و یا مفهوم خاصی در وب بگردد، باید به وب‌سایت‌های مختلف مراجعه کرده و اطلاعات آن‌ها را با هم مقایسه کند. اگر بتوان اطلاعات موجود در وب در زمینه‌ای خاص را به‌صورت یکپارچه و معنادار در کنار یکدیگر قرار داد، در وقت و هزینه‌ی کاربر صرفه‌جویی می‌شود. برای انجام این کار باید ابتدا اطلاعات موجود در وب استخراج شده و سپس به‌صورت یکپارچه در کنار یکدیگر قرار گیرند. این رساله برای استخراج اطلاعات، از وب‌سرویس‌ها و برای یکپارچه‌سازی آن‌ها از وب‌معنایی استفاده کرده است. این رساله به‌طور خاص از آنتولوژی استفاده کرده و آنتولوژی کتاب را تهیه کرده است. بدین‌صورت که ابتدا یک آنتولوژی اولیه ساخته شده است. سپس اطلاعات موجود در وب در مورد کتاب از طریق وب‌سرویس‌ها استخراج شده و در قالب یک آنتولوژی ذخیره شده است. در مرحله‌ی بعد این آنتولوژی‌ها باید با یکدیگر تطبیق یابند تا یک آنتولوژی یکپارچه ساخته شود. جهت انجام این‌کار باید مشابهت‌های معنایی، رشته‌ای و ساختاری این آنتولوژی‌ها درنظرگرفته شود. این رساله برای بررسی مشابهت معنایی و رشته‌ای از اطلاعات زمینه‌ای (فرهنگ‌لغت‌هایی) مثل ویکی‌پدیا، وُردنِت، گوگل و غیره استفاده کرده و برای بررسی مشابهت ساختاری از درختِ این آنتولوژی‌ها استفاده کرده است. در نهایت، آنتولوژی یکپارچه‌ی نهایی ساخته و نمونه‌سازی می‌شود.
بررسی و بهبود روش‌های تطبیق آنتولوژی‌ها
نویسنده:
زهرا قاسمی نیک
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
نیاز به معنا بخشیدن به محتویات وب، به‌گونه‌ای که برای ماشین‌های مختلف قابل فهم باشد، ایده اصلی ظهور وب معنایی است. اما با طراحی آنتولوژی‌ها، توسط افراد و سازمان‌های مختلف در حوزه‌های گوناگون، سطحی از ناهمگونی اطلاعات به سیستم تحمیل شده است که با تطبیق صحیح آنتولوژی‌ها می‌توان این مشکل وب‏معنایی را نیز حل کرد. با وجود تحقیقات بسیاری که در سال‌های اخیر در زمینه‌ی تطبیق خودکار آنتولوژی‌ها انجام شده، چالش بزرگ تعامل میان آنتولوژی‌ها در شرایط گوناگون همچنان به قوت خود باقی است. این پایان‌نامه در پی یافتن روش‌هایی برای افزایش کارایی سیستم‌های موجود در شرایط مختلف است. این تحقیق متشکل از دو بخش است. در پژوهش اول با استفاده از روش ترکیبی یادگیری ماشین، آدابوست، سیستم‌های موفق تطبیق با یکدیگر ترکیب می‌شوند؛ بدین ترتیب تطبیق‌گرهای مختلف نقاط ضعف یکدیگر را پوشش می‌دهند. نتایج ناشی از پژوهش افزایش دقت و کارایی این روش را نسبت به بهترین تطبیق‌گرهای مجزا نشان می‌دهد. در پژوهش دوم از دامنه‌ی گسترده‌ی اطلاعاتی ویکی‌پدیا، به‏عنوان منبع زبانی، استفاده شده است. به این صورت که سیستم با افزایش دامنه‌ی اطلاعاتی هر تطبیق‌گر در حوزه‏های گوناگون، سعی در بهبود نتایج آن دارد. در این پژوهش نیز کارایی هر سیستم نسبت به قبل افزایش یافته است.
دسته‌بندی اسناد فارسی به کمک هستان‌شناسی فارس‌نت
نویسنده:
صباسادات مدنی
نوع منبع :
رساله تحصیلی , کتابخانه عمومی
وضعیت نشر :
ایرانداک,
چکیده :
با توجه به رشد روزافزون اسناد الکترونیکی، نیاز به یک دسته بند کارا در حوزه داده کاوی واضح است. اخیراً به منظور افزایش دقت دسته بندی، استفاده از آنتولوژی لغوی به عنوان مرجع خارجی و نیز استخراج دانش از متون در فرآیند دسته بندی، مطرح شده است؛ از این رو، هدف از انجام این پروژه ارائه و پیاده سازی سیستم دسته بندی خودکار اسنادی است که آنتولوژی لغوی فارس نت را در عملیات دسته بندی داخل می نماید. این امر منجر به افزایش اوزان کلمات مرتبط با دانش پیش زمینه متن می شود. راهکار پیشنهادی برای استفاده از آنتولوژی لغوی، تمرکز بر روی بردار مشخصه ی معنایی را محور فعالیت های خود قرار داده است؛ تا بدین وسیله فرآیند دسته بندی را بهبود بخشد. در این پروژه ضمن بررسی و مطالعه ی روش های بکارگیری آنتولوژی لغوی در فرآیند دسته بندی، آنتولوژی لغوی فارس نت را به منظور استخراج روابط معنایی استفاده می نماییم.در سیستم ارائه شده، کلیه ی اجزاء تشکیل دهنده ی سیستم دسته بندی شامل پردازشگر لغوی، کاهنده ی ویژگی، انتخاب کننده ی ویژگی، وزن دهی به ویژگی و طبقه بندی کننده اسناد، لحاظ شده است. در این پروژه الگوریتم χ^2 در بخش انتخاب مشخصه و روش وزن دهی ویژگی نرمال شده TFIDF در بخش وزن دهی به کار گرفته می شود. پیش از اعمال روش وزن دهی به مشخصه ها، بردار مشخصه معنایی برای هر کلمه کلیدی توسط مفاهیم استخراج شده از آنتولوژی لغوی فارس نت، ایجاد می شود. نتایج ارزیابی های انجام شده نشان دهنده ی بهبود قابل توجهی در کارایی و دقت الگوریتم دسته بندی با بکارگیری آنتولوژی لغوی فارس نت است.
  • تعداد رکورد ها : 21