شباهت معنایی جملات فارسی با استفاده از تطبیق فضای برداری و یادگیری عمیق | ||
| پدافند الکترونیکی و سایبری | ||
| دوره 10، شماره 2 - شماره پیاپی 38، پاییز 1401، صفحه 43-56 اصل مقاله (1.6 M) | ||
| نوع مقاله: مقاله پژوهشی | ||
| نویسندگان | ||
| سعیده سادات سدیدپور* 1؛ مینا حاجی غلامرضا2؛ محمدرضا محمدزاده2؛ سید محمدرضا محمدی2؛ محمدعلی کیوانراد1 | ||
| 1استادیار، دانشگاه صنعتی مالکاشتر، تهران، ایران | ||
| 2کارشناسی ارشد، دانشگاه صنعتی مالک اشتر، تهران، ایران | ||
| چکیده | ||
| امروزه، شناسایی متون مشابه، موضوعی با کاربردهای فراوان میباشد که با توجه به اهمیت آن، توسط پژوهشگران زبانهای مختلف مورد تحلیل و بررسی قرار گرفته است. در گذشته اغلب برای درک جملات توسط سامانههای رایانهای، جملات بهصورت مجموعه کلمات مورد بررسی قرار میگرفتند. اما امروزه، با گسترش فناوری و استفاده از شبکههای عصبی عمیق، میتوان از خود جملات، مفهوم اصلی را استخراج نمود. بنابراین، رسیدن به مدلی که بتواند جملات را کدگذاری کرده و مفهوم اصلی جمله را با دقت هر چه بیشتر استخراج نماید، یکی از نیازهای ضروری برای این هدف به شمار میرود. این مقاله قصد دارد تا میزان شباهت جملات را از نقطه نظر معنایی بهدست آورد که از روشهای یادگیری عمیق استفاده میکند. از آنجایی که روشهای یادگیری عمیق نیاز به داده آموزشی زیادی دارند، این مقاله از ایده نگاشت بین زبانی بهره میبرد. روش پیشنهادی، فضای برداری تعبیه کلمات انگلیسی را به فارسی نگاشت کرده و با کمک مدل آموزش داده شده در زبان انگلیسی، شباهت جملات فارسی بهدست میآید. درنهایت، نتایج نهایی با امتیازات انسانی مورد مقایسه قرار گرفته است. نتایج حاصل از روش پیشنهادی، میزان دقت این سامانه پیشنهادی را 89 درصد ارائه میدهد که نسبت به سایر مدلهای یادگیری عمیق برتری دارد. | ||
| کلیدواژهها | ||
| استخراج مفهوم جملات؛ تعبیه کلمات؛ یادگیری عمیق؛ مشابهتیابی؛ تطبیق فضای برداری | ||
| مراجع | ||
|
| ||
|
آمار تعداد مشاهده مقاله: 1,136 تعداد دریافت فایل اصل مقاله: 790 |
||