Suy luận, Triển khai & Thời gian chạy

vllm

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 89,5KSố sao
⑂ 21KFork
6832Vấn đề đang mở
PythonNgôn ngữ
Apache-2.0Giấy phép
Q98Điểm biên tập

Tổng quan

A high-throughput and memory-efficient inference and serving engine for LLMs

Yêu cầu, cài đặt và bắt đầu nhanh

Yêu cầu cài đặt không được nêu trong siêu dữ liệu của kho lưu trữ.

Cách sử dụng

Thông tin sử dụng không được nêu trong siêu dữ liệu của kho lưu trữ.

Khả năng tương thích của mô hình và trường hợp sử dụng

Khả năng tương thích của mô hình không được nêu trong siêu dữ liệu của kho lưu trữ.

Ghi chú về giấy phép và rủi ro

Apache-2.0

ToolAI metadata-only listing: repository metadata is public; editorial content and manual verification are still pending.

sglang

sgl-project/sglang

★ 32,2KPython

OpenVINO

openvinotoolkit/openvino

★ 10,6KC++

GPUStack

gpustack/gpustack

★ 5,4KPython

FastDeploy

PaddlePaddle/FastDeploy

★ 3,7KPython