Deutsch
← Zurück zu KI-Technologien

Modellarchitektur

Mixture of Experts (MoE)

Eine Familie gerouteter Expertenarchitekturen. Moderne dünn aktivierte Varianten wählen pro Eingabe nur bestimmte Experten und erhöhen so die Kapazität, ohne für jedes Token alle Parameter zu nutzen.

Referenzzeitraum
1991 / 2017 / 2021
Zuletzt geprüft

Schlüsselbegriffe

  • experts
  • router
  • sparse activation
  • load balancing

Verknüpfungen im Projekt

Primärquellen

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Dies ist eine kuratierte technische Karte und kein Anspruch auf Vollständigkeit.