Aprendizado multimodal

2 min
  1. Qual unidade é preciso manter inteira durante o split de dados multimodais?
  2. O que verifica o controle em que os pares imagem–texto são misturados aleatoriamente?
  3. Por que retirar uma modalidade durante a avaliação?
  4. Qual comportamento é preciso definir quando um sensor falta em produção?
  5. Um desempenho global superior prova que todas as modalidades são úteis?

Respostas. 1. A entidade que liga as vistas — cena, pessoa, sessão ou documento — a fim de evitar que outra vista do mesmo caso atravesse as partições. 2. Que o ganho depende de um alinhamento real e não de atalhos unimodais ou da frequência das classes. 3. Uma ablação mede a contribuição de cada fonte e revela uma modalidade decorativa. 4. Um modo degradado explícito, uma abstenção ou um fallback testado. 5. Não: são necessárias ablações, casos contraditórios, entradas ausentes e uma comparação ao melhor modelo unimodal no mesmo orçamento.

Pré-visualização — o resto da lição está reservado aos inscritos.

Já se inscreveu com um código?

O seu acesso está ligado à sua conta, não a esta ligação. Inicie sessão com o mesmo e-mail usado na aula: o seu curso está à espera, não precisa de introduzir o código de novo.

Iniciar sessãoAinda não tem conta? Criar uma
Esta lição faz parte do módulo «Aprofundamentos modernos»

Os primeiros módulos do curso são de acesso livre. Para o resto há três possibilidades: comprar este curso de uma vez por todas, subscrever, ou introduzir o código entregue na aula.

Subscrever — 19 $ US/mêsVoltar ao plano
É estudante do curso?

O código fica ligado à sua conta: inicie sessão ou crie uma conta e ele será aplicado automaticamente ao regressar.

Ainda não tem conta? Criar uma