FastDeploy
PaddlePaddle/FastDeploy
High-performance Inference and Deployment Toolkit for LLMs and VLMs based on PaddlePaddle
ToolAI.io · GitHub 频道
一个基于事实的 LLM、智能体、MCP、RAG 和 AI 开发项目索引;每个条目均包含许可证、设置、下载、截图及相关资源。
公开仓库数据
PaddlePaddle/FastDeploy
High-performance Inference and Deployment Toolkit for LLMs and VLMs based on PaddlePaddle
langwatch/langwatch
一个开放核心平台,用于在发布前及生产环境中评估、测试、追踪和监控 LLM 应用与 AI 智能体。
truera/trulens
TruLens 是一个开源的、原生支持 OpenTelemetry 的评估与追踪库,适用于 LLM 应用和 AI 智能体。它帮助开发者追踪每一步骤,使用 LLM 作为评判者对性能进行打分,并比较不同版本的应用。
modelscope/evalscope
一个轻量且可定制的大模型(LLM、VLM、AIGC)评测与性能基准测试框架。
vllm-project/vllm-ascend
一个由社区维护的硬件插件,使 vLLM 能够在受支持的 Ascend NPU 上运行模型推理与服务工作负载。
bionic-gpt/bionic-gpt
Bionic 是一个基于 Rust 的本地部署 ChatGPT 替代方案,面向私有生成式 AI 部署。它提供熟悉的聊天界面、本地或远程模型访问、团队控制、检索增强助手、数据集成、可观测性以及面向 Kubernetes 的扩展能力。
mozilla-ai/any-llm
any-llm 是一个 Python SDK,可通过统一接口与多个 LLM 提供商通信。它支持以较少代码改动切换提供商和模型,并在可用时使用官方提供商 SDK。
future-agi/future-agi
一个开源、可自托管的平台,用于评估、追踪、模拟、保护、路由和优化 LLM 及 AI 智能体应用。
theopenco/llmgateway
Route, manage, and analyze your LLM requests across multiple providers with a unified API interface.
xllm-ai/xllm
xLLM 是一个 C++ 推理框架,支持 LLM、VLM、DiT 和 REC 模型。它面向多个 AI 加速器系列提供高吞吐、低延迟部署,并将服务层的调度与可用性职责同引擎层计算分离。
wenyuchiou/awesome-agentic-ai-zh
A trilingual (繁中 / English / 简中) learning roadmap for agentic AI: from LLM basics to multi-agent systems, with 240+ curated resources and hands-on examples. 中文 AI agent 學習地圖。
PaddlePaddle/PaddleNLP
Easy-to-use and powerful LLM and SLM library with awesome model zoo.
第 5 / 11 页 · 126 个项目