نتائج المشتركة ل LORESMT 2021 المشتركة على CovID ولغة الإشارة لغات الموارد المنخفضة


الملخص بالعربية

نقدم نتائج المهمة المشتركة ل LORESMT 2021 التي تركز على الترجمة الآلية (MT) من بيانات CovID-19 لكل من اللغات المنطوقة والتسوق المنخفضة الموارد. تم إجراء تنظيم هذه المهمة كجزء من ورشة العمل الرابعة حول تكنولوجيات الترجمة الآلية لغات الموارد المنخفضة (LORESMT). يتم تقديم Corpora المتوازي والمتاحة للجمهور والتي تتضمن الاتجاهات التالية: English↔irish، English↔marathi، وتايوانية Language Language Chinese. تتكون بيانات التدريب من 8112 و 20933 و 128608، على التوالي. هناك مجموعات بيانات أحادية الأحادية الإضافية للماراثية والإنجليزية التي تتكون من 21901 شريحة. تعتمد النتائج المقدمة هنا على مداخل من إجمالي ثمانية فرق. قدم ثلاثة فرق أنظمة للإنجليز في حين أن خمسة فرق قدمت أنظمة ل EnglishMarathi. لسوء الحظ، لم تكن هناك عروض أنظمة لمهمة التايوانية للتايوانية. تم حساب أقصى أداء النظام باستخدام BLEU ومتابعة AS 36.0 للغة الإنجليزية - الأيرلندية، 34.6 للأيرلندية - الإنجليزية، 24.2 للغة الإنجليزية - الماراثي، و 31.3 للماراثي - الإنجليزية.

المراجع المستخدمة

https://aclanthology.org/

تحميل البحث