Apprentissage multimodal

2 min
  1. Quelle unité faut-il garder entière lors du split de données multimodales ?
  2. Que vérifie le contrôle où les paires image–texte sont mélangées aléatoirement ?
  3. Pourquoi retirer une modalité pendant l'évaluation ?
  4. Quel comportement faut-il définir lorsqu'un capteur manque en production ?
  5. Une performance globale supérieure prouve-t-elle que toutes les modalités sont utiles ?

Réponses. 1. L'entité qui relie les vues — scène, personne, session ou document — afin d'éviter qu'une autre vue du même cas traverse les partitions. 2. Que le gain dépend d'un alignement réel plutôt que de raccourcis unimodaux ou de la fréquence des classes. 3. Une ablation mesure la contribution de chaque source et révèle une modalité décorative. 4. Un mode dégradé explicite, une abstention ou un fallback testé. 5. Non : il faut des ablations, des cas contradictoires, des entrées manquantes et une comparaison au meilleur modèle unimodal au même budget.

Aperçu — la suite de la leçon est réservée aux inscrits.

Déjà inscrit avec un code ?

Votre accès est rattaché à votre compte, pas à ce lien. Connectez-vous avec le même courriel qu'en classe : votre cours vous attend, inutile de ré-entrer le code.

Se connecterPas encore de compte ? En créer un
Cette leçon fait partie du module « Approfondissements modernes »

Les premiers modules du cours sont en accès libre. Pour la suite, trois possibilités : acheter ce cours une fois pour toutes, vous abonner pour tout ouvrir, ou entrer le code si vous suivez le cours en classe.

M’abonner — 19 $ US/moisRetour au plan
Vous êtes étudiant du cours ?

Le code se rattache à votre compte : connectez-vous ou créez un compte, il sera validé automatiquement au retour.

Pas encore de compte ? En créer un