Русский
← Назад к технологиям ИИ

Архитектура моделей

Mixture of Experts (MoE)

Семейство архитектур с маршрутизацией между экспертными подсетями. Современные разреженные варианты активируют лишь выбранных экспертов, увеличивая ёмкость без использования всех параметров для каждого токена.

Опорный период
1991 / 2017 / 2021
Последняя проверка

Ключевые термины

  • experts
  • router
  • sparse activation
  • load balancing

Связи внутри проекта

Первичные источники

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Это отобранная техническая карта, а не заявление о полном охвате.