हिन्दी
← AI प्रौद्योगिकी पर लौटें

अनुमान और तैनाती

Open-model Inference Ecosystem

vLLM और llama.cpp जैसे इंजन और रनटाइम डाउनलोड किए जा सकने वाले मॉडल भारों को स्थानीय या सर्वर अनुमान में बदल देते हैं। निर्गम, हार्डवेयर पोर्टेबिलिटी, मॉडल प्रारूप और संचालन की जटिलता के मामले में इनकी प्राथमिकताएँ अलग-अलग हैं।

संदर्भ अवधि
2023–present
अंतिम समीक्षा

मुख्य शब्द

  • vLLM
  • llama.cpp
  • GGUF
  • local inference

पूरी परियोजना में जुड़ाव

किसके द्वारा प्रयुक्त

संबंधित प्रौद्योगिकी

संबंधित अनुभाग

प्राथमिक स्रोत

  1. vLLM documentation
  2. llama.cpp

यह एक चुना हुआ तकनीकी मानचित्र है, सम्पूर्ण कवरेज का दावा नहीं।