已弃用:LangSmith 可观测性 Helm 图表已弃用。我们不再维护或提供支持。以下文档仅供参考。
第 1 部分:Prometheus 导出器
如果您只想为自托管部署中的组件部署指标导出器,然后使用您的遥测系统抓取这些指标,请使用此部分。如果您希望为您部署完整的可观测性套件,请转到端到端部署部分。 该 Helm 图表提供了一组 Prometheus 导出器,用于暴露来自 Redis、Postgres、Nginx 和 Kube 状态指标 的指标。- 创建一个名为
langsmith_obs_config.yaml的本地文件。 - 将此文件中的值复制到
langsmith_obs_config.yaml中,确保修改这些值以匹配您的 LangSmith 部署。 - 运行
helm search repo langchain/langsmith-observability --versions查找图表的最新版本。 - 获取最新版本号,然后运行
helm install langsmith-observability langchain/langsmith-observability --values langsmith_obs_config.yaml --version <version> -n <namespace> --wait --debug
- Postgres:
langsmith-observability-postgres-exporter:9187/metrics - Redis:
langsmith-observability-redis-exporter:9121/metrics - Nginx:
langsmith-observability-nginx-exporter:9113/metrics - KubeStateMetrics:
langsmith-observability-kube-state-metrics:8080/metrics
kubectl get pods -n langsmith-observability,您应该会看到:
第 2 部分:完整的可观测性套件
本节将向您展示如何使用 Helm 图表 为 LangSmith 部署端到端的可观测性套件。 该图表基于 Grafana 的开源 LGTM 套件构建。它包括: 以及用于收集遥测数据的 OpenTelemetry 收集器。先决条件
1. 计算资源
套件各部分的资源请求和限制可以在 Helm 图表中修改。以下是当前的分配(请求/限制):- Loki:
2vCPU/3vCPU + 2Gi/4Gi - Mimir:
1vCPU/2vCPU + 2Gi/4Gi - Tempo:
1vCPU/2vCPU + 4Gi/6Gi
2. Cert-Manager
Helm 图表使用 OpenTelemetry Operator 来配置收集器。该 Operator 要求您在 Kubernetes 集群中安装 cert-manager。 如果您尚未安装,可以运行以下命令:3. OpenTelemetry operator
使用以下命令安装 OpenTelemetry Operator:安装
以下说明将启动 OTel 收集器、LGTM 套件、Grafana 和 Prometheus 导出器。- 创建一个名为
langsmith_obs_config.yaml的本地文件。 - 将此文件中的值复制到
langsmith_obs_config.yaml中,确保修改这些值以匹配您的 LangSmith 部署。 - 运行
helm search repo langchain/langsmith-observability --versions查找图表的最新版本。 - 获取最新版本号,然后运行
helm install langsmith-observability langchain/langsmith-observability --values langsmith_obs_config.yaml --version <version> -n <namespace> --wait --debug
您可以通过修改配置文件中
otelCollector 下的布尔值来选择性地收集日志、指标或跟踪。您也可以选择性地启动后端的各个部分(Loki、Mimir、Tempo)。kubectl get pods -n langsmith-observability,您应该会看到:
安装后
在 LangSmith 中启用日志和跟踪
安装可观测性 Helm 图表后,您需要在 LangSmith Helm 配置文件中设置以下值,以启用日志和跟踪的收集。- 要获取
${LANGSMITH_OTEL_CRD_NAME},您可以运行kubectl get opentelemetrycollectors -n ${LANGSMITH_OBS_NAMESPACE}并选择 MODE =sidecar的那个的名称。 - 要获取
${GATEWAY_COLLECTOR_SERVICE_NAME}名称,运行kubectl get services -n ${LANGSMITH_OBS_NAMESPACE}并选择端口为 4317/4318 且设置了 ClusterIP 的那个。它应该类似于langsmith-observability-collector-gateway-collector。
helm upgrade langsmith langchain/langsmith --values langsmith_config.yaml -n <langsmith-namespace> --wait --debug
升级后,如果您运行 kubectl get pods -n <langsmith-namespace>,您应该会看到以下内容(注意 sidecar 收集器的 2/2):
Grafana 使用
一切安装完成后,执行以下操作以获取您的 Grafana 密码:langsmith-observability-grafana 容器的 3000 端口,并在浏览器中打开 localhost:3000。使用用户名 admin 和上述密钥中的密码登录 Grafana。
进入 Grafana 后,您可以使用 UI 监控日志、指标和跟踪。Grafana 还预装了一组仪表板,用于监控部署的主要组件。

将这些文档 通过 MCP 连接到 Claude、VSCode 等,以获取实时答案。

