Inferensi, Deployment & Runtime

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,4KBintang
⑂ 20,9KFork
6746Isu terbuka
PythonBahasa
Apache-2.0Lisensi
Q@project.QualityScoreSkor editorial

Ringkasan

A high-throughput and memory-efficient inference and serving engine for LLMs

Persyaratan, instalasi, dan mulai cepat

Persyaratan instalasi tidak tercantum dalam metadata repositori.

Penggunaan

Penggunaan tidak dicantumkan dalam metadata repositori.

Kompatibilitas model dan kasus penggunaan

Kompatibilitas model tidak tercantum dalam metadata repositori.

Catatan lisensi dan risiko

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,1KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython