Français
← Retour aux technologies de l’IA

Architecture des modèles

Mixture of Experts (MoE)

Une famille d’architectures à experts routés. Les variantes clairsemées modernes n’activent que certains experts par entrée, ce qui accroît la capacité sans mobiliser tous les paramètres pour chaque jeton.

Période de référence
1991 / 2017 / 2021
Dernière vérification

Termes clés

  • experts
  • router
  • sparse activation
  • load balancing

Liens dans le projet

Sources primaires

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Cette carte est une sélection éditoriale, non une prétention à l’exhaustivité.