ToolAI.io · GitHub 频道

GitHub 上的开源 AI 项目

一个基于事实的 LLM、智能体、MCP、RAG 和 AI 开发项目索引;每个条目均包含许可证、设置、下载、截图及相关资源。

公开仓库数据

项目索引

24 项目
DeepSeek-R1:Reasoning model research and evaluation 的截图
LLM 与基础模型 精选

DeepSeek-R1:Reasoning model research and evaluation

deepseek-ai/DeepSeek-R1

ToolAI 对 deepseek-ai/DeepSeek-R1 的客观项目介绍。An open-source project focused on reasoning model research and evaluation.

★ 92K⑂ 11.7KPython
MITQ86
Hugging Face Transformers 的截图
推理、部署与运行时

Hugging Face Transformers

huggingface/transformers

一个面向文本、视觉、音频和多模态领域最先进机器学习模型的模型定义框架,同时支持推理和训练。

★ 163.3K⑂ 34.1KPython
Apache-2.0Q98
推理、部署与运行时

OpenVINO

openvinotoolkit/openvino

用于在边缘到云环境中优化和部署 AI 推理的开源工具包。

★ 10.6K⑂ 3.3KC++
Apache-2.0Q98
Xorbits Inference (Xinference) 的截图
推理、部署与运行时

Xorbits Inference (Xinference)

xorbitsai/inference

一个强大且通用的库,旨在为语言、语音识别和多模态模型提供服务。它允许用户仅通过更改一行代码即可将 GPT 替换为任意 LLM,并通过统一的、生产就绪的推理 API 在云端、本地或本地服务器上运行模型。

★ 9.5K⑂ 853Python
Apache-2.0Q98
Plano:面向智能体应用的原生 AI 代理服务器与数据平面 的截图
智能体与多智能体

Plano:面向智能体应用的原生 AI 代理服务器与数据平面

katanemo/plano

Plano 是一款使用 Rust 构建的原生 AI 代理服务器与数据平面,可集中处理 LLM 路由、智能体编排、可观测性和防护栏,使开发者能够专注于核心智能体逻辑,而非底层基础设施。

★ 7K⑂ 484Rust
Apache-2.0Q98
推理、部署与运行时

Mooncake:以 KVCache 为中心的分布式 LLM 服务基础设施

kvcache-ai/mooncake

Mooncake 是一个面向大规模 LLM 推理和训练的 C++ 基础设施项目。它将预填充、解码和存储资源解耦,并提供高性能数据传输、分布式 KV 缓存存储及具备容错能力的专家并行通信。

★ 6.1K⑂ 1KC++
Apache-2.0Q98
推理、部署与运行时

GPUStack

gpustack/gpustack

GPUStack 是一款开源 GPU 集群管理器,用于服务 AI 模型并按需提供可通过 SSH 访问的 GPU 实例。它可在本地部署、Kubernetes 和云环境中编排包括 vLLM、SGLang 和 TensorRT-LLM 在内的推理引擎。

★ 5.4K⑂ 604Python
Apache-2.0Q98
Lemonade:面向 GPU 和 NPU 推理的本地 AI 服务器 的截图
MCP 与工具调用

Lemonade:面向 GPU 和 NPU 推理的本地 AI 服务器

lemonade-sdk/lemonade

Lemonade 是一个开源的本地 AI 服务器,允许用户直接在自己的 GPU 和 NPU 上运行优化的大语言模型(LLM)、语音及图像生成模型,提供了一种免费且私有的云 API 替代方案。

★ 5.2K⑂ 436C++
Apache-2.0Q98
CSGHub:开源大语言模型资产管理平台 的截图
智能体与多智能体

CSGHub:开源大语言模型资产管理平台

opencsgs/csghub

CSGHub 是一个开源的本地化部署平台,用于管理大语言模型资产的全生命周期,包括模型、数据集、空间和代码,提供类似于私有化 Hugging Face 的功能。

★ 4.2K⑂ 525Vue
Apache-2.0Q98
推理、部署与运行时

llm-d:在 Kubernetes 上进行分布式 LLM 推理

llm-d/llm-d

llm-d 是一个开源服务栈,围绕 vLLM 和 SGLang 等模型服务器提供分布式编排、路由、缓存管理、自动扩缩容和批处理能力。它面向 Kubernetes 和现代硬件加速器上的大规模生产推理。

★ 4K⑂ 649Shell
Apache-2.0Q98
推理、部署与运行时

vLLM Ascend

vllm-project/vllm-ascend

一个由社区维护的硬件插件,使 vLLM 能够在受支持的 Ascend NPU 上运行模型推理与服务工作负载。

★ 2.7K⑂ 2.1KC++
Apache-2.0Q98

第 1 / 2 页 · 24 个项目

最近更新

codex:Coding agent and developer workflowsopenai/codex★ 106.5K NemoClaw:Agent runtime and deployment toolingNVIDIA/NemoClaw★ 22.2K XERJxerj-org/xerj★ 1.4K LangWatchlangwatch/langwatch★ 3.5K OrchestKityonatangross/orchestkit★ 222 hal0hal0ai/hal0★ 67

星标最多

Hermes Agentnousresearch/hermes-agent★ 227.1K markitdown:Document conversion and extractionmicrosoft/markitdown★ 174.2K skills:Reusable agent skills and workflowsanthropics/skills★ 169.9K Hugging Face Transformershuggingface/transformers★ 163.3K Firecrawlfirecrawl/firecrawl★ 161.1K LangChainlangchain-ai/langchain★ 143.6K