Architecture des modèles
Transformer
Une architecture neuronale fondée sur l’attention qui traite en parallèle les positions d’une séquence. Elle sous-tend de nombreux modèles de langage et multimodaux modernes.
Termes clés
- self-attention
- encoder
- decoder
- positional encoding
Liens dans le projet
Technologies liées
Articles liés
Contexte historique
Sources primaires
Cette carte est une sélection éditoriale, non une prétention à l’exhaustivité.