العربية
العودة إلى تقنيات الذكاء الاصطناعي

الاستدلال والنشر

Quantization

تمثيل الأوزان أو التفعيلات أو الذواكر بدقة عددية أدنى. وقد يخفض ذلك كلف الذاكرة وعرض النطاق والحساب، مع مقايضات في الدقة وفي دعم العتاد.

الفترة المرجعية
2015 / LLM PTQ 2022
آخر مراجعة

المصطلحات الأساسية

  • precision
  • INT8
  • INT4
  • weight-only

الروابط عبر المشروع

المصادر الأولية

  1. Deep Compression
  2. GPTQ
  3. Transformers quantization documentation

هذه خريطة تقنية منتقاة، لا ادّعاء بتغطية شاملة.