Key points are not available for this paper at this time.
أظهر الكثير من التقدم الحديث في NLU أنه نتيجة لتعلم النماذج حيَل محددة للبيانات. نقوم بإجراء دراسة حالة على التعميم في NLI (من MNLI إلى مجموعة بيانات HANS التي تم بناؤها بشكل عدائي) في مجموعة من معماريات BERT (المحولات التوأمية، المحولات السيامية، HEX لإزالة التحيز)، بالإضافة إلى أخذ عينات فرعية من البيانات وزيادة حجم النموذج. نبلغ عن استراتيجيتين ناجحتين و3 استراتيجيات غير ناجحة، جميعها تقدم رؤى حول كيفية تعلم النماذج القائمة على المحولات للتعميم.
درس باهارجافا وزملاؤه (الجمعة) هذا السؤال.