Distinguir placar bruto, ativação oculta, probabilidade e classe escolhida.
Prova de sucesso: explique "Ativações, logits e escolha final", realize "Do placar às partes" e cite o limite da analogia.
No torneio de padrões, Zoé obtém três números: 2,1; −0,4; 0,8. São logits, não probabilidades: eles não estão limitados entre 0 e 1 nem são obrigados a somar 1. Softmax os transforma em proporções positivas que somam 1. A categoria com o maior placar pode ser escolhida, mas a equipe também guarda a incerteza e um limite de abstenção para os casos muito próximos.
Uma resposta convincente liga uma entrada a uma saída medida. Mantenha esses três fatos à vista. Aqui, seu ponto de referência é "Ativações, logits e escolha final".
O caminho distingue ativação, logits, normalização e regra de decisão em vez de tratar Softmax como uma certeza. Leia o desenho de cima para baixo: cada seta anuncia uma transformação ou uma verificação, nunca um pensamento da máquina.
A analogia: Os logits se parecem com os pontos brutos de um júri, e Softmax com uma conversão para partes comparáveis.
Onde ela para: Uma probabilidade verdadeira exige mais do que uma conversão matemática: se o modelo estiver mal calibrado ou fora de contexto, uma parte de 90% pode ser enganosa. Uma analogia ajuda a começar; ela não substitui nem os dados, nem os cálculos, nem um teste.
Material: três cartas-logits 2, 1 e 0, seis fichas, uma regra ReLU e uma tabela Softmax simplificada
Tempo sugerido: 10 a 20 minutos.
Observação esperada: placar, ativação, probabilidade e decisão são quatro objetos diferentes que não se deve confundir.
Adicione a mesma constante aos três logits. Verifique se as proporções Softmax não mudam, depois explique essa invariância.
Forçar uma escolha pode esconder a incerteza. Em uma situação sensível, autorize "insuficiente para decidir" e passe o caso para uma pessoa competente.
Pergunta responsável: Quem define o limite de abstenção e quais erros devem ser examinados antes de escolhê-lo?
Um logit deve estar entre 0 e 1?
Correção: Não. É um placar bruto que pode ser negativo ou maior que 1.
Por que uma ativação não linear entre as camadas?
Correção: Ela permite representar relações que um empilhamento puramente linear não consegue criar.
Uma saída Softmax de 0,9 garante a classe correta?
Correção: Não. É preciso verificar a calibração e o contexto em dados separados.
Intérprete dos placares — Você ganha este distintivo se conseguir explicar o esquema sem ler, mostrar o resultado da atividade e corrigir uma resposta errada com gentileza.