Arquitetura de modelos
Transformer
Uma arquitetura neural baseada em atenção que processa posições de uma sequência em paralelo. Tornou-se a base de muitos modelos modernos de linguagem e multimodais.
Termos-chave
- self-attention
- encoder
- decoder
- positional encoding
Ligações no projeto
Tecnologias relacionadas
Artigos relacionados
Contexto histórico
Fontes primárias
Este é um mapa técnico selecionado, não uma afirmação de cobertura completa.