photoprism
photoprism/photoprism
可自托管的照片与视频管理系统,用自动标签、人脸分组和元数据检索帮助整理大型个人图库。
ToolAI.io · GitHub 频道
一个基于事实的 LLM、智能体、MCP、RAG 和 AI 开发项目索引;每个条目均包含许可证、设置、下载、截图及相关资源。
ToolAI 对 microsoft/markitdown 的客观项目介绍。Python tool for converting files and office documents to Markdown
★ 174.9K · PythonToolAI 对 anthropics/skills 的客观项目介绍。Public repository for Agent Skills
★ 170.6K · MarkdownToolAI 对 anthropics/claude-code 的客观项目介绍。Claude Code is an agentic coding tool that lives in your terminal, understands your codebase, and helps you code faster by executing routine tasks, explaining complex code, and handling git workflows - all through natural language commands
★ 142.1K · TypeScriptToolAI 对 openai/whisper 的客观项目介绍。Robust Speech Recognition via Large-Scale Weak Supervision
★ 107.7K · PythonToolAI 对 deepseek-ai/DeepSeek-V3 的客观项目介绍。An open-source project focused on large language model research and inference.
★ 104.4K · PythonToolAI 对 deepseek-ai/DeepSeek-R1 的客观项目介绍。An open-source project focused on reasoning model research and evaluation.
★ 92K · Python由 Nous Research 构建的自改进 AI 智能体,具备闭环学习、多平台消息集成以及灵活的模型提供商切换功能。设计用于在低成本 VPS、GPU 集群或无服务器基础设施上运行。
★ 227.1K · Python一个面向文本、视觉、音频和多模态领域最先进机器学习模型的模型定义框架,同时支持推理和训练。
★ 163.3K · Python一款开源的网络上下文 API,支持大规模搜索、抓取网页并与网络交互,将网页数据转换为干净的 Markdown 或结构化 JSON,供 AI 智能体和大语言模型(LLM)使用。
★ 161.1K · TypeScript MCP 与工具调用Dify 是一个 LLM 应用开发平台,用于可视化构建工作流、RAG 管道和可调用工具的智能体。它在协作工作区中整合了模型管理、提示词开发、可观测性和应用 API,可作为托管服务使用或自行托管。
★ 151.2K · TypeScript一个开源的 Python 框架,通过可互操作、可链式组合的组件和第三方集成,构建由大语言模型驱动的应用与智能体。
★ 143.6K · PythonGraphify 是一款本地优先的 CLI 工具和 AI 助手技能,通过确定性的 AST 解析,将代码库、文档、SQL 架构和 PDF 解析为可查询的知识图谱,无需依赖向量存储或嵌入。
★ 104K · Python公开仓库数据
photoprism/photoprism
可自托管的照片与视频管理系统,用自动标签、人脸分组和元数据检索帮助整理大型个人图库。
2noise/ChatTTS
面向中英文对话的语音生成项目,支持说话人和停顿、笑声等韵律控制;发布模型限非商业用途。
naptha/tesseract.js
把 Tesseract OCR 引擎带到浏览器和 Node.js,通过 WebAssembly 识别图像文字,适合网页端轻量文字提取。
google/langextract
利用大模型从非结构化文本抽取字段和关系,并将结果定位回原文,适合需要复核证据的文档结构化流程。
TencentARC/GFPGAN
利用生成式人脸先验修复低质量人像,适合老照片和人脸清晰化实验,可与背景超分辨率工具组合处理整张图片。
CopilotKit/CopilotKit
连接应用界面与 Agent 的 SDK,提供聊天、共享状态、生成式 UI 和人工确认,让 AI 能参与实际业务操作。
google-ai-edge/mediapipe
面向移动端、浏览器和边缘设备的机器学习组件,提供视觉、文本与音频任务 API、模型及定制工具。
microsoft/graphrag
从文本构建实体关系与社区摘要,用图结构组织问答上下文,适合探索跨文档主题;当前上游已说明主要进入维护模式。
huggingface/diffusers
用于加载和组合扩散模型的 Python 库,提供生成管线、模型组件、调度器和训练示例,适合构建可编程的图像与多模态生成流程。
qdrant/qdrant
支持向量、稀疏向量和元数据过滤的检索引擎,适合给知识问答、推荐与相似内容搜索提供可独立部署的数据层。
explosion/spaCy
面向工程应用的 NLP 流水线,提供分词、实体识别、句法分析和文本分类,适合将稳定的文本任务做成可训练、可部署组件。
lutzroeder/netron
可视化查看模型计算图、张量与输入输出结构,支持多种模型格式,适合模型交接、导出检查和部署前排查。
第 15 / 25 页 · 295 个项目