Français
← Retour aux technologies de l’IA

Architecture des modèles

Transformer

Une architecture neuronale fondée sur l’attention qui traite en parallèle les positions d’une séquence. Elle sous-tend de nombreux modèles de langage et multimodaux modernes.

Période de référence
2017
Dernière vérification

Termes clés

  • self-attention
  • encoder
  • decoder
  • positional encoding

Liens dans le projet

Sources primaires

  1. Attention Is All You Need

Cette carte est une sélection éditoriale, non une prétention à l’exhaustivité.