أسئلة المتابعة الترطفة بصريا: مجموعة بيانات من الأسئلة المكانية التي تتطلب تاريخ الحوار


الملخص بالعربية

في هذه الورقة، نحدد وتقييم منهجية لاستخراج الأسئلة المكانية التي تعتمد على التاريخ من الحوارات البصرية.نقول أن السؤال يعتمد على التاريخ إذا كان يتطلب (أجزاء) تاريخ حواره المراد تفسيره.نقول أن بعض أنواع الأسئلة المرئية تحدد السياق الذي يعتمد عليه سؤال مكاني للمتابعة.نسمي السؤال الذي يقيد السياق: الزناد، ونحن نسمي السؤال المكاني الذي يتطلب الإجابة على سؤال الزناد: Zoomer.نستخرج تلقائيا أزواج الزناد و Zoomer المختلفة بناء على خاصية Visual التي تعتمد الأسئلة عليها (على سبيل المثال، اللون، رقم).نحل تدريجيا يدويا أزواج الزناد و Zoomer المستخرجة تلقائيا للتحقق من أن Zoomers التي تتطلب الزناد.نحن ننفذ بنية أساسية بسيطة بناء على تشفير سوتا متعددة الوسائط.نتائجنا تكشف أن هناك مساحة كبيرة لتحسين الإجابة على الأسئلة التي تعتمد على التاريخ.

المراجع المستخدمة

https://aclanthology.org/

تحميل البحث