Русский
← Назад к технологиям ИИ

Инференс и развёртывание

Open-model Inference Ecosystem

Движки и среды выполнения, такие как vLLM и llama.cpp, превращают доступные веса в локальный или серверный инференс. Их приоритеты различаются по пропускной способности, переносимости, форматам и сложности эксплуатации.

Опорный период
2023–present
Последняя проверка

Ключевые термины

  • vLLM
  • llama.cpp
  • GGUF
  • local inference

Связи внутри проекта

Первичные источники

  1. vLLM documentation
  2. llama.cpp

Это отобранная техническая карта, а не заявление о полном охвате.