Español
← Volver a Tecnologías de IA

Inferencia y despliegue

Open-model Inference Ecosystem

Motores y entornos como vLLM y llama.cpp convierten pesos descargables en inferencia local o de servidor. Sus prioridades varían entre rendimiento, portabilidad de hardware, formatos y complejidad operativa.

Periodo de referencia
2023–present
Última revisión

Términos clave

  • vLLM
  • llama.cpp
  • GGUF
  • local inference

Conexiones en el proyecto

Fuentes primarias

  1. vLLM documentation
  2. llama.cpp

Este es un mapa técnico seleccionado, no una afirmación de cobertura completa.