Visión moderna: detección, segmentación y ViT

2 min
  1. ¿Qué salida distingue detección y clasificación?
  2. ¿Para qué sirve el IoU?
  3. ¿Qué métrica conviene a una máscara por píxel?
  4. ¿Cómo transforma un ViT una imagen en secuencia?
  5. [E] ¿Por qué no comparar mAP, accuracy y Dice como si fueran una misma puntuación?

Respuestas. 1. Cajas localizadas además de las clases. 2. Para medir el solapamiento. 3. IoU o Dice por clase. 4. Proyecta parches en tokens. 5. Estas métricas se refieren a objetos, geometrías y reglas de emparejamiento diferentes.

Objetivo: ir más allá de la clasificación de la imagen completa.

La detección predice clases y cajas; la segmentación semántica atribuye una clase a cada píxel; la segmentación de instancias distingue los objetos de una misma clase.

Vista previa: el resto de la lección está reservado a los inscritos.

¿Ya te inscribiste con un código?

Tu acceso está vinculado a tu cuenta, no a este enlace. Inicia sesión con el mismo correo que usaste en clase: tu curso te espera, no hace falta volver a introducir el código.

Iniciar sesión¿Aún no tienes cuenta? Crear una
Esta lección forma parte del módulo «Profundizaciones modernas»

Los primeros módulos del curso son de acceso libre. Para el resto hay tres opciones: comprar este curso de una vez, suscribirte, o introducir el código entregado en clase.

Suscribirme — 19 $ US/mesVolver al plan
¿Eres estudiante del curso?

El código se vincula a tu cuenta: inicia sesión o crea una cuenta y se aplicará automáticamente al volver.

¿Aún no tienes cuenta? Crear una