Key points are not available for this paper at this time.
تمكن محركات التعرف على النصوص الحالية من تدريب نماذج عامة للتعرف على ليس فقط يد واحدة معينة ولكن أيضًا مجموعة متنوعة من الأيدي التاريخية ضمن نص معين، ومن فترة زمنية كبيرة (أكثر من 100 عام). تقارن هذه الورقة بين محركات التعرف على النصوص المختلفة وأدائها على مجموعة اختبار مستقلة عن مجموعات التدريب والتحقق. نحن نت argument أن كلاً من مجموعة الاختبار والحقائق الواقعية يجب أن تكون متاحة من قبل الباحثين كجزء من مهمة مشتركة للسماح بمقارنة المحركات. سيعطي هذا نظرة ثاقبة على نطاق الخيارات الممكنة للمؤسسات التي تحتاج إلى نماذج التعرف. كأداة اختبار، نقدم مجموعة بيانات تتكون من 2426 سطراً تم اختيارها عشوائياً من محاضر اجتماعات المجلس الفيدرالي السويسري من عام 1848 إلى 1903. على حد علمنا، لم يتم استخدام أي من السطور النصية المذكورة أعلاه، والتي نأخذها كحقائق واقعية، أو مجموعة الأيادي المختلفة داخل هذه المجموعة لتدريب نماذج التعرف على النصوص المكتوبة بخط اليد. بالإضافة إلى ذلك، فإن مجموعة البيانات المستخدمة مثالية لإجراء المقارنات المتعلقة بمحركات التعرف ومجموعات التدريب الكبيرة بسبب تنوعها والفترة الزمنية التي تغطيها. وبالتالي، تجادل هذه الورقة بأن كلا المحركين الذين تم اختباره، HTR+ و PyLaia، يمكنهما التعامل مع مجموعات تدريب كبيرة. وأسفرت النماذج الناتجة عن نتائج جيدة جداً في مجموعة اختبار تتكون من أيدي غير معروفة ولكنها مشابهة من حيث الأسلوب.
دراسة هودل وآخرون (Fri) هذا السؤال.
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: