Bahasa Indonesia
← Kembali ke Teknologi AI

Inferensi dan penggelaran

Open-model Inference Ecosystem

Mesin dan runtime seperti vLLM dan llama.cpp mengubah bobot model yang dapat diunduh menjadi inferensi lokal atau di server. Prioritas keduanya berbeda pada keluaran, keterbawaan perangkat keras, format model, dan kerumitan operasional.

Periode rujukan
2023–present
Terakhir ditinjau

Istilah kunci

  • vLLM
  • llama.cpp
  • GGUF
  • local inference

Terhubung di seluruh proyek

Sumber primer

  1. vLLM documentation
  2. llama.cpp

Ini adalah peta teknis terkurasi, bukan klaim cakupan yang menyeluruh.