Inferencia, implementación y tiempo de ejecución

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,4KEstrellas
⑂ 20,9KBifurcaciones
6746Problemas abiertos
PythonIdioma
Apache-2.0Licencia
Q@project.QualityScorePuntuación editorial

Resumen

A high-throughput and memory-efficient inference and serving engine for LLMs

Requisitos, instalación y guía rápida

Los requisitos de instalación no se indican en los metadatos del repositorio.

Uso

El uso no se indica en los metadatos del repositorio.

Compatibilidad de modelos y casos de uso

La compatibilidad del modelo no se indica en los metadatos del repositorio.

Notas sobre la licencia y los riesgos

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,1KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython