Bahasa Indonesia
← Kembali ke Teknologi AI

Arsitektur model

Mixture of Experts (MoE)

Keluarga arsitektur pakar terarah. Varian jarang masa kini hanya mengaktifkan subjaringan pakar terpilih untuk setiap masukan, sehingga kapasitas bertambah tanpa mengaktifkan setiap parameter pada setiap token.

Periode rujukan
1991 / 2017 / 2021
Terakhir ditinjau

Istilah kunci

  • experts
  • router
  • sparse activation
  • load balancing

Terhubung di seluruh proyek

Sumber primer

  1. Adaptive Mixtures of Local Experts
  2. Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer
  3. Switch Transformers

Ini adalah peta teknis terkurasi, bukan klaim cakupan yang menyeluruh.