Italiano
← Torna alle tecnologie dell’IA

Architettura dei modelli

Mixture of Experts (MoE)

Una famiglia di architetture con esperti instradati. Le varianti sparse moderne attivano solo alcuni esperti per input, aumentando la capacità senza usare tutti i parametri per ogni token.

Periodo di riferimento
1991 / 2017 / 2021
Ultima verifica

Termini chiave

  • experts
  • router
  • sparse activation
  • load balancing

Collegamenti nel progetto

Fonti primarie

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Questa è una mappa tecnica curata, non una pretesa di copertura completa.