Inférence, déploiement et exécution

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,4KÉtoiles
⑂ 20,9KForks
6746Problèmes ouverts
PythonLangue
Apache-2.0Licence
Q@project.QualityScoreScore éditorial

Vue d’ensemble

A high-throughput and memory-efficient inference and serving engine for LLMs

Prérequis, installation et démarrage rapide

Les exigences d'installation ne sont pas indiquées dans les métadonnées du dépôt.

Utilisation

L’utilisation n’est pas indiquée dans les métadonnées du dépôt.

Compatibilité des modèles et cas d’usage

La compatibilité des modèles n’est pas indiquée dans les métadonnées du dépôt.

Licence et notes sur les risques

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,1KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython