Inferentie, implementatie en runtime

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,5KSterren
⑂ 21KForks
6832Openstaande problemen
PythonTaal
Apache-2.0Licentie
Q98Redactionele score

Overzicht

A high-throughput and memory-efficient inference and serving engine for LLMs

Vereisten, installatie en snel aan de slag

Installatievereisten staan niet vermeld in de metadata van de repository.

Gebruik

Het gebruik wordt niet vermeld in de metagegevens van de repository.

Modelcompatibiliteit en gebruiksscenario's

Modelcompatibiliteit staat niet vermeld in de metadata van de repository.

Licentie- en risiconotities

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,2KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython

FastDeploy

PaddlePaddle/FastDeploy

★ 3,7KPython