Inferência, implantação e execução

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,4KEstrelas
⑂ 20,9KForks
6746Problemas em aberto
PythonIdioma
Apache-2.0Licença
Q@project.QualityScorePontuação editorial

Visão geral

A high-throughput and memory-efficient inference and serving engine for LLMs

Requisitos, instalação e início rápido

Os requisitos de instalação não estão especificados nos metadados do repositório.

Uso

O uso não é informado nos metadados do repositório.

Compatibilidade do modelo e casos de uso

A compatibilidade do modelo não está especificada nos metadados do repositório.

Observações sobre licença e riscos

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,1KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython