Key points are not available for this paper at this time.
الملخص: أحد أكبر التحديات التي تعوق التقدم في ترجمة الآلات قليلة الموارد ومتعددة اللغات هو نقص مؤشرات التقييم الجيدة. مؤشرات التقييم الحالية إما تفتقر إلى تغطية جيدة للغات قليلة الموارد، أو تركز فقط على مجالات محدودة، أو تكون ذات جودة منخفضة لأنها تم إنشاؤها باستخدام إجراءات شبه آلية. في هذا العمل، نقدم مؤشر تقييم فلوريس-101، الذي يتكون من 3001 جملة مستخرجة من ويكيبيديا الإنجليزية وتغطي مجموعة متنوعة من المواضيع والمجالات المختلفة. تم ترجمة هذه الجمل إلى 101 لغة من قبل مترجمين محترفين من خلال عملية خاضعة للتحكم بعناية. تتيح مجموعة البيانات الناتجة تقييمًا أفضل لجودة النموذج على ذيل اللغات قليلة الموارد، بما في ذلك تقييم أنظمة الترجمة متعددة اللغات من نوع عدة إلى عدة، حيث جميع الترجمات متوافقة تمامًا. من خلال إصدار مجموعة بيانات عالية الجودة وذات تغطية واسعة علنًا، نأمل في تعزيز التقدم في مجتمع ترجمة الآلات وما وراءه.
قام جويال وآخرون (السبت) بدStudy هذه المسألة.