NVIDIA NeMo Speech
nvidia-nemo/speech
一个可扩展的生成式 AI 框架,专为从事自动语音识别 (ASR)、文本转语音 (TTS) 和语音大语言模型的研究人员和 PyTorch 开发者构建。
ToolAI.io · GitHub 频道
一个基于事实的 LLM、智能体、MCP、RAG 和 AI 开发项目索引;每个条目均包含许可证、设置、下载、截图及相关资源。
公开仓库数据
nvidia-nemo/speech
一个可扩展的生成式 AI 框架,专为从事自动语音识别 (ASR)、文本转语音 (TTS) 和语音大语言模型的研究人员和 PyTorch 开发者构建。
browseros-ai/browseros
BrowserOS 是一款免费、开源的 Chromium 分支,内置 AI 智能体,并附带 BrowserOS neo——一款专为 AI 智能体设计的辅助浏览器。它支持本地优先的浏览器自动化,兼容多种 LLM 提供商和 MCP 兼容工具。
langchain4j/langchain4j
一个符合 Java 习惯的开源 JVM 库,用于构建基于大语言模型(LLM)的应用程序。它为流行的 LLM 提供商和向量存储提供了统一的 API,并支持工具调用、MCP、智能体和 RAG。
neuml/txtai
txtai 是一个基于 Python 的 AI 框架,用于语义与向量搜索、检索增强生成、LLM 编排、自主智能体及多模态语言模型工作流。
dataelement/bisheng
BISHENG 是一个开源的 LLM 应用 DevOps 平台,面向下一代企业级 AI 应用,提供 GenAI 工作流编排、RAG、Agent 管理以及企业级系统管控等全面功能。
langchain-ai/open-swe
Open SWE 是一个用于构建内部编程代理的开源框架。它基于 LangGraph 和 Deep Agents 构建,提供云沙箱、Slack/Linear/GitHub 调用、子代理编排以及面向工程团队的自动创建 PR 功能。
xorbitsai/inference
一个强大且通用的库,旨在为语言、语音识别和多模态模型提供服务。它允许用户仅通过更改一行代码即可将 GPT 替换为任意 LLM,并通过统一的、生产就绪的推理 API 在云端、本地或本地服务器上运行模型。
oumi-ai/oumi
Oumi 是一个基于 Python 的平台,用于数据准备、开放权重基础模型训练与微调、结果评估、推理运行和模型部署。它提供配置配方及统一 CLI,支持本地、集群和云端工作流。
maximhq/bifrost
Bifrost 是一个基于 Go 的 AI 网关,为 23+ 家 AI 提供商提供统一的、兼容 OpenAI 的 API。它支持路由、故障转移、负载均衡、语义缓存、治理、可观测性、多模态请求、插件和模型上下文协议集成。
katanemo/plano
Plano 是一款使用 Rust 构建的原生 AI 代理服务器与数据平面,可集中处理 LLM 路由、智能体编排、可观测性和防护栏,使开发者能够专注于核心智能体逻辑,而非底层基础设施。
clearml/clearml
ClearML 是一个开源的 MLOps/LLMOps 套件,提供自动化的 CI/CD 以简化 AI 工作负载。它将实验管理、数据管理、流水线编排、调度和模型服务集成到一个综合平台中。
plastic-labs/honcho
用于构建有状态 AI 智能体的记忆基础设施,能够理解随时间变化的用户、智能体、群体、项目和想法。
第 3 / 7 页 · 75 个项目