vLLM Ascend
vllm-project/vllm-ascend
一个由社区维护的硬件插件,使 vLLM 能够在受支持的 Ascend NPU 上运行模型推理与服务工作负载。
ToolAI.io · GitHub 频道
一个基于事实的 LLM、智能体、MCP、RAG 和 AI 开发项目索引;每个条目均包含许可证、设置、下载、截图及相关资源。
公开仓库数据
vllm-project/vllm-ascend
一个由社区维护的硬件插件,使 vLLM 能够在受支持的 Ascend NPU 上运行模型推理与服务工作负载。
bionic-gpt/bionic-gpt
Bionic 是一个基于 Rust 的本地部署 ChatGPT 替代方案,面向私有生成式 AI 部署。它提供熟悉的聊天界面、本地或远程模型访问、团队控制、检索增强助手、数据集成、可观测性以及面向 Kubernetes 的扩展能力。
mozilla-ai/any-llm
any-llm 是一个 Python SDK,可通过统一接口与多个 LLM 提供商通信。它支持以较少代码改动切换提供商和模型,并在可用时使用官方提供商 SDK。
future-agi/future-agi
一个开源、可自托管的平台,用于评估、追踪、模拟、保护、路由和优化 LLM 及 AI 智能体应用。
xllm-ai/xllm
xLLM 是一个 C++ 推理框架,支持 LLM、VLM、DiT 和 REC 模型。它面向多个 AI 加速器系列提供高吞吐、低延迟部署,并将服务层的调度与可用性职责同引擎层计算分离。
askimo-ai/askimo
一款原生桌面 AI 客户端,支持聊天、本地 RAG、多步 AI 工作流(Plans)及代理技能,兼容多种云端和本地 LLM 提供商,同时确保用户文件严格保留在本地机器上。
juspay/neurolink
一个 TypeScript 集成平台,提供统一的 API 接入 30+ 家 AI 供应商和 100+ 种模型,支持供应商切换、多模态语音处理、RAG、记忆功能以及 MCP 原生工具集成。
artokun/comfyui-mcp
一个本地优先、原生支持代理的 ComfyUI 控制平面,提供 MCP 服务器和侧边栏代理,可跨任何 LLM 使用自然语言生成图像、视频和音频,创建与运行工作流,以及编辑实时图谱。
reyamira/models
一款用于浏览 AI 模型、基准测试、编程代理和提供商状态的 TUI 和 CLI 工具。
avifenesh/memra
一个从零开始使用 Rust 和 CUDA 构建的 LLM 推理引擎,专门针对 RTX 5090 (sm_120a) 和 H100 (sm_90a) 架构进行优化,在不依赖 ggml 等框架的情况下提供精确性约束的性能。
sno-ai/llmix
一款面向 AI 代理和工具的生产级 LLM 调用层,通过配置驱动的模型预设、缓存、弹性模式及密钥轮换,封装了现有的提供商 SDK,支持 Python、TypeScript 和 Rust。
taichuy/1flowbase
一款开源 AI 网关,允许本地代理客户端将融合式多模型工作流发布为兼容 OpenAI 和 Claude 的虚拟模型,并提供对追踪、Token、延迟和成本的完全可观测性。
第 5 / 7 页 · 75 个项目