Инференс, развёртывание и среда выполнения

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,5KЗвёзды
⑂ 21KФорки
6832Открытые проблемы
PythonЯзык
Apache-2.0Лицензия
Q98Редакционная оценка

Обзор

A high-throughput and memory-efficient inference and serving engine for LLMs

Требования, установка и быстрый старт

В метаданных репозитория требования к установке не указаны.

Использование

В метаданных репозитория сведения об использовании не указаны.

Совместимость моделей и варианты использования

В метаданных репозитория совместимость моделей не указана.

Лицензия и примечания о рисках

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,2KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython

FastDeploy

PaddlePaddle/FastDeploy

★ 3,7KPython