Español
← Volver a Tecnologías de IA

Arquitectura de modelos

Mixture of Experts (MoE)

Una familia de arquitecturas con expertos enrutados. Las variantes dispersas modernas activan solo algunos expertos por entrada, aumentando la capacidad sin usar todos los parámetros en cada token.

Periodo de referencia
1991 / 2017 / 2021
Última revisión

Términos clave

  • experts
  • router
  • sparse activation
  • load balancing

Conexiones en el proyecto

Fuentes primarias

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Este es un mapa técnico seleccionado, no una afirmación de cobertura completa.