Inferenza, distribuzione e runtime

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,5KStelle
⑂ 21KFork
6832Problemi aperti
PythonLingua
Apache-2.0Licenza
Q98Punteggio editoriale

Panoramica

A high-throughput and memory-efficient inference and serving engine for LLMs

Requisiti, installazione e avvio rapido

I requisiti di installazione non sono indicati nei metadati del repository.

Utilizzo

L’utilizzo non è indicato nei metadati del repository.

Compatibilità del modello e casi d'uso

La compatibilità del modello non è indicata nei metadati del repository.

Note su licenza e rischi

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,2KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython

FastDeploy

PaddlePaddle/FastDeploy

★ 3,7KPython