项目截图
概览
TruLens 帮助开发者识别 AI 智能体在何处失败,以及在不牺牲质量的前提下可以在哪里降低成本。通过使用原生支持 OpenTelemetry 的追踪功能,它能够捕获函数调用、LLM 生成、检索和工具调用的结构化跨度(spans)。这使得追踪数据可以导出至任何兼容 OTLP 的后端。该库为智能体系统提供了专门构建的评估器,并支持内联和批量评估模式,允许团队在应用运行时或基于预收集的数据集进行评估。
主要功能
- 基于 OpenTelemetry 的追踪,可移植至现有的可观测性后端
- 七个专门构建的智能体评估器(LogicalConsistency, ExecutionEfficiency, PlanAdherence, PlanQuality, ToolSelection, ToolCalling, ToolQuality)
- 通过 Run API 支持内联和批量评估模式
- 支持模型上下文协议(MCP)以对工具调用进行插桩
- 提供 Selector API 以在评估期间定位特定的跨度属性
- 提供排行榜,用于按分数、延迟和成本比较应用版本
要求、安装和快速入门
用法
模型兼容性与使用场景
通过专用包支持 LLM 提供商:OpenAI/Azure OpenAI、LiteLLM(Anthropic、Cohere、Mistral 等)、Google Gemini、AWS Bedrock、Snowflake Cortex、HuggingFace 和 LangChain 模型。
许可证与风险说明
MIT License.
Editorial verification 2026-08-09: repository URL, owner, description, license and repository statistics were reviewed. License metadata: MIT. README was fetched for the channel draft; re-check repository dependencies, releases and model terms before production use.
发布与维护
Not stated in the repository metadata