Inferensi, Deployment & Runtime

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,5KBintang
⑂ 21KFork
6832Isu terbuka
PythonBahasa
Apache-2.0Lisensi
Q98Skor editorial

Ringkasan

A high-throughput and memory-efficient inference and serving engine for LLMs

Persyaratan, instalasi, dan mulai cepat

Persyaratan instalasi tidak tercantum dalam metadata repositori.

Penggunaan

Penggunaan tidak dicantumkan dalam metadata repositori.

Kompatibilitas model dan kasus penggunaan

Kompatibilitas model tidak tercantum dalam metadata repositori.

Catatan lisensi dan risiko

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,2KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython

FastDeploy

PaddlePaddle/FastDeploy

★ 3,7KPython