Como funciona o mecanismo de atenção
O passo a passo do self-attention, a operação por trás dos modelos de linguagem: dos tokens e embeddings à codificação de posição, às matrizes Q, K e V, ao softmax e aos pesos de atenção. As matrizes são editáveis e a matemática roda no navegador.
