التدريب 03 — تصنيف النصوص بالمتتاليات والانتباه

1 دقيقة
  1. لماذا نضبط Tokenizer على مجموعة التدريب فقط؟
  2. ما شكل المُعرِّفات (IDs) لدُفعة B بطول L؟
  3. ما الاختبار الذي يكشف padding مُقنَّعاً بشكل خاطئ؟
  4. لماذا Macro-F1 بدل الدقّة عند وجود أصناف نادرة؟
  5. [E] فيمَ يفيد خط أساس TF-IDF أمام GRU؟

الأجوبة. 1. وإلاّ يتسرَّب المعجم إحصاءاتٍ من الاختبار. 2. B×L، مثل القناع. 3. إضافة padding لا يجب أن تُغيِّر التنبؤ. 4. لأن كل صنف يزن بالتساوي. 5. يقيس ما إذا كان الترتيب التسلسلي يُضيف مكسباً يتجاوز مجرّد وجود الكلمات.

معاينة — بقية الدرس متاحة للمسجّلين فقط.

هل سجّلت من قبل برمز؟

وصولك مرتبط بحسابك وليس بهذا الرابط. سجّل الدخول بنفس البريد الذي استخدمته في الصف: دورتك بانتظارك، ولا حاجة لإدخال الرمز مجددًا.

تسجيل الدخولليس لديك حساب بعد؟ أنشئ حسابًا
هذا الدرس جزء من وحدة «التطبيقات العملية (5 تدريبات)»

الوحدات الأولى من الدورة مفتوحة للجميع. أما البقية فأمامك ثلاثة خيارات: شراء هذه الدورة مرة واحدة، أو الاشتراك، أو إدخال الرمز الموزّع في القاعة.

هل أنت طالب في هذه الدورة؟

يرتبط الرمز بحسابك: سجّل الدخول أو أنشئ حسابًا وسيُطبَّق تلقائيًا عند عودتك.

ليس لديك حساب بعد؟ أنشئ حسابًا