Aprendizaje multimodal

2 min
  1. ¿Qué unidad hay que mantener entera durante el split de datos multimodales?
  2. ¿Qué verifica el control en el que los pares imagen–texto se mezclan aleatoriamente?
  3. ¿Por qué retirar una modalidad durante la evaluación?
  4. ¿Qué comportamiento hay que definir cuando falta un sensor en producción?
  5. ¿Un rendimiento global superior demuestra que todas las modalidades son útiles?

Respuestas. 1. La entidad que relaciona las vistas — escena, persona, sesión o documento — para evitar que otra vista del mismo caso atraviese las particiones. 2. Que la ganancia depende de un alineamiento real y no de atajos unimodales o de la frecuencia de las clases. 3. Una ablación mide la contribución de cada fuente y revela una modalidad decorativa. 4. Un modo degradado explícito, una abstención o un fallback probado. 5. No: hacen falta ablaciones, casos contradictorios, entradas faltantes y una comparación con el mejor modelo unimodal con el mismo presupuesto.

Vista previa: el resto de la lección está reservado a los inscritos.

¿Ya te inscribiste con un código?

Tu acceso está vinculado a tu cuenta, no a este enlace. Inicia sesión con el mismo correo que usaste en clase: tu curso te espera, no hace falta volver a introducir el código.

Iniciar sesión¿Aún no tienes cuenta? Crear una
Esta lección forma parte del módulo «Profundizaciones modernas»

Los primeros módulos del curso son de acceso libre. Para el resto hay tres opciones: comprar este curso de una vez, suscribirte, o introducir el código entregado en clase.

Suscribirme — 19 $ US/mesVolver al plan
¿Eres estudiante del curso?

El código se vincula a tu cuenta: inicia sesión o crea una cuenta y se aplicará automáticamente al volver.

¿Aún no tienes cuenta? Crear una