العربية
العودة إلى تقنيات الذكاء الاصطناعي

الاستدلال والنشر

Open-model Inference Ecosystem

محرّكات وأزمنة تشغيل مثل vLLM وllama.cpp تحوّل أوزان النماذج القابلة للتنزيل إلى استدلال محلي أو خادمي. وتختلف أولوياتها بين الإنتاجية وقابلية النقل بين العتاد وصيغ النماذج والتعقيد التشغيلي.

الفترة المرجعية
2023–present
آخر مراجعة

المصطلحات الأساسية

  • vLLM
  • llama.cpp
  • GGUF
  • local inference

الروابط عبر المشروع

المصادر الأولية

  1. vLLM documentation
  2. llama.cpp

هذه خريطة تقنية منتقاة، لا ادّعاء بتغطية شاملة.