Vision moderne : détection, segmentation et ViT

2 min
  1. Quelle sortie distingue détection et classification ?
  2. À quoi sert l'IoU ?
  3. Quelle métrique convient à un masque par pixel ?
  4. Comment un ViT transforme-t-il une image en séquence ?
  5. [E] Pourquoi ne pas comparer mAP, accuracy et Dice comme un même score ?

Réponses. 1. Des boîtes localisées en plus des classes. 2. À mesurer le recouvrement. 3. IoU ou Dice par classe. 4. Il projette des patchs en tokens. 5. Ces métriques portent sur des objets, géométries et règles d'appariement différents.

Objectif : dépasser la classification d'image entière.

La détection prédit classes et boîtes ; la segmentation sémantique attribue une classe à chaque pixel ; la segmentation d'instances distingue les objets d'une même classe.

Aperçu — la suite de la leçon est réservée aux inscrits.

Déjà inscrit avec un code ?

Votre accès est rattaché à votre compte, pas à ce lien. Connectez-vous avec le même courriel qu'en classe : votre cours vous attend, inutile de ré-entrer le code.

Se connecterPas encore de compte ? En créer un
Cette leçon fait partie du module « Approfondissements modernes »

Les premiers modules du cours sont en accès libre. Pour la suite, trois possibilités : acheter ce cours une fois pour toutes, vous abonner pour tout ouvrir, ou entrer le code si vous suivez le cours en classe.

M’abonner — 19 $ US/moisRetour au plan
Vous êtes étudiant du cours ?

Le code se rattache à votre compte : connectez-vous ou créez un compte, il sera validé automatiquement au retour.

Pas encore de compte ? En créer un