العربية
العودة إلى تقنيات الذكاء الاصطناعي

الاستدلال والنشر

Speculative Decoding

طريقة استدلال يقترح فيها مسوّدة أسرع عدة رموز يتحقّق منها النموذج الهدف على التوازي. وقد تخفض زمن التوليد دون تغيير توزيع الهدف.

الفترة المرجعية
2022
آخر مراجعة

المصطلحات الأساسية

  • draft model
  • verification
  • latency
  • exact sampling

الروابط عبر المشروع

المصادر الأولية

  1. Fast Inference from Transformers via Speculative Decoding

هذه خريطة تقنية منتقاة، لا ادّعاء بتغطية شاملة.