Português
← Voltar às tecnologias de IA

Arquitetura de modelos

Mixture of Experts (MoE)

Uma família de arquiteturas com especialistas encaminhados. As variantes esparsas modernas ativam apenas alguns especialistas por entrada, aumentando a capacidade sem mobilizar todos os parâmetros em cada token.

Período de referência
1991 / 2017 / 2021
Última revisão

Termos-chave

  • experts
  • router
  • sparse activation
  • load balancing

Ligações no projeto

Fontes primárias

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Este é um mapa técnico selecionado, não uma afirmação de cobertura completa.