訓練與後訓練
Distributed Training
將資料、參數、啟用值或計算拆分到多台裝置與節點的技術。它讓大型模型訓練成為可能,同時引入通訊、同步與容錯取捨。
關鍵術語
- data parallelism
- tensor parallelism
- pipeline parallelism
- sharding
專案內關聯
第一手來源
這是經過選編的技術圖譜,並非對 AI 技術的完整涵蓋聲明。
訓練與後訓練
將資料、參數、啟用值或計算拆分到多台裝置與節點的技術。它讓大型模型訓練成為可能,同時引入通訊、同步與容錯取捨。
這是經過選編的技術圖譜,並非對 AI 技術的完整涵蓋聲明。