学習と後学習
Distributed Training
データ、パラメータ、活性値、計算を複数デバイスやノードへ分割する技術です。大規模モデルの学習を可能にする一方、通信、同期、耐障害性のトレードオフを生みます。
主要用語
- data parallelism
- tensor parallelism
- pipeline parallelism
- sharding
プロジェクト内のつながり
一次資料
これは選定された技術マップであり、網羅性を主張するものではありません。
学習と後学習
データ、パラメータ、活性値、計算を複数デバイスやノードへ分割する技術です。大規模モデルの学習を可能にする一方、通信、同期、耐障害性のトレードオフを生みます。
これは選定された技術マップであり、網羅性を主張するものではありません。