TP 03 — Classification de texte avec séquence et attention

2 min
  1. Pourquoi ajuster le tokenizer sur train seulement ?
  2. Quelle forme ont des IDs pour un lot B de longueur L ?
  3. Quel test révèle un padding mal masqué ?
  4. Pourquoi Macro-F1 plutôt qu'accuracy avec des classes rares ?
  5. [E] À quoi sert la baseline TF-IDF face à une GRU ?

Réponses. 1. Sinon le vocabulaire fuit des statistiques du test. 2. B×L, comme le masque. 3. Ajouter du padding ne doit pas changer la prédiction. 4. Chaque classe pèse également. 5. Elle mesure si l'ordre séquentiel apporte un gain au-delà des mots présents.

Aperçu — la suite de la leçon est réservée aux inscrits.

Déjà inscrit avec un code ?

Votre accès est rattaché à votre compte, pas à ce lien. Connectez-vous avec le même courriel qu'en classe : votre cours vous attend, inutile de ré-entrer le code.

Se connecterPas encore de compte ? En créer un
Cette leçon fait partie du module « Travaux pratiques (5 TP) »

Les premiers modules du cours sont en accès libre. Pour la suite, trois possibilités : acheter ce cours une fois pour toutes, vous abonner pour tout ouvrir, ou entrer le code si vous suivez le cours en classe.

M’abonner — 19 $ US/moisRetour au plan
Vous êtes étudiant du cours ?

Le code se rattache à votre compte : connectez-vous ou créez un compte, il sera validé automatiquement au retour.

Pas encore de compte ? En créer un