تولید خودکار متن فارسی با استفاده مدلهای مبتنی بر قاعده و تعبیه واژگان | ||
| پدافند الکترونیکی و سایبری | ||
| مقاله 4، دوره 9، شماره 4 - شماره پیاپی 36، زمستان 1400، صفحه 43-54 اصل مقاله (1.08 M) | ||
| نوع مقاله: مقاله پژوهشی | ||
| نویسندگان | ||
| امید حاجی پور1؛ سعیده سادات سدیدپور* 2 | ||
| 1دانشجوی دکتری، دانشگاه صنعتی امیرکبیر، تهران، ایران | ||
| 2استادیار، دانشگاه صنعتی مالکاشتر، تهران، ایران | ||
| چکیده | ||
| تولید زبان طبیعی از پردازش زبان طبیعی حاصل میشود. زبان طبیعی از یک سیستم ارائه ماشینی مانند پایگاه دانش تولید میشود. سیستمهای NLG از مدتها پیش وجود داشته اما فنّاوری آن به صورت ابزار تجاری اخیراً بهصورت گسترده به وجود آمده است. در NLG، سیستم نیاز به تصمیمگیری در مورد چگونگی قرار دادن یک مفهوم در کلمات دارد. توانایی ایجاد متن معنیدار نقش کلیدی در بسیاری از کاربردهای پردازش زبان طبیعی مانند ترجمه ماشین، گفتار و تبدیل عکس به متن دارد. هدف این پروژه ارائه روشی برای تولید متن با استفاده از روشهای هوش مصنوعی و با ساختار درست و آغازی برای تولید متن فارسی است. به عبارت دیگر در این مقاله روشی ارائه شده که قادر به تولید متن طولانی متنوع علاوه بر حفظ معنا و ساختار در زبان فارسی میباشد. جهت پیشبرد تولید متن سعی شده از ترکیب روشهای یادگیری ماشین با مدلهای احتمالاتی، استفاده شود. در مدل پیشنهادی از مدلهای احتمالاتی برای استخراج قوانین و از Word2vec برای برداریسازی متن استفاده شده و سپس در فاز تولید از ترکیب این دو و فاصله کسینوسی استفاده میشود. نتایج نشاندهنده ارائه مدلی بوده که متن تولیدی آن دارای ساختار، مفهوم و تنوع مناسب میباشد. همچنین این مدل از نظر انسانی و پیچیدگی نیز بهینه میباشد. | ||
| کلیدواژهها | ||
| تولید زبان طبیعی؛ تولید خودکار متن؛ مدل زبانی؛ روش مبتنی بر قاعده؛ تعبیه کلمات | ||
| مراجع | ||
|
| ||
|
آمار تعداد مشاهده مقاله: 1,081 تعداد دریافت فایل اصل مقاله: 720 |
||