Bahasa Indonesia
← Kembali ke Teknologi AI

Pelatihan dan pascapelatihan

Distributed Training

Teknik yang membagi data, parameter, aktivasi, atau komputasi ke berbagai perangkat dan simpul. Teknik ini memungkinkan pelatihan model besar, tetapi memunculkan pertukaran pada komunikasi, sinkronisasi, dan toleransi kegagalan.

Periode rujukan
2012–present
Terakhir ditinjau

Istilah kunci

  • data parallelism
  • tensor parallelism
  • pipeline parallelism
  • sharding

Terhubung di seluruh proyek

Sumber primer

  1. ImageNet Classification with Deep Convolutional Neural Networks
  2. Efficient Large-Scale Language Model Training on GPU Clusters Using Megatron-LM
  3. PyTorch Fully Sharded Data Parallel

Ini adalah peta teknis terkurasi, bukan klaim cakupan yang menyeluruh.