LangSmith 01:追踪——让 Agent 运行过程可见

2026-09-01
11254 分钟
...

1、本篇任务:从一次错误回答找到具体失败步骤

应用日志常只告诉你请求失败;Agent 却可能在路由、检索、工具、模型或输出校验任一层出错。LangSmith Trace 用父子 run 记录完整调用树,使一次用户请求可以沿步骤检查。

本课为退款助手建立 support_run → retrieve/order/tool → compose 的追踪层级。

2、Run 与 Trace 的关系

一个 run 表示一个工作单元,多个父子 run 组成 trace:

support_run
  ├─ classify_intent
  ├─ retrieve_policy
  │    └─ rerank
  ├─ get_order
  └─ compose_answer
       └─ model_call

根 run 对应用户可见结果;子 run 对应可独立计时、失败和评测的步骤。不要把每次字符串拼接都追踪,也不要只追踪最终模型调用。

3、LangChain/LangGraph 自动追踪

配置 LangSmith 环境变量并启用 tracing 后,LangChain 模型、工具和 Agent 通常会自动形成层级。为 run 添加稳定名称、tags 和 metadata,便于按环境与版本筛选。

metadata 推荐包含 environment、release、prompt_version、index_version、request_id、匿名 tenant/user ID。禁止放认证 token、密钥、身份证、完整支付数据或不必要的原始文档。

4、追踪框架外函数

Python:

from langsmith import traceable

@traceable(name="retrieve_policy", run_type="retriever")
def retrieve_policy(question: str, tenant_id: str):
    return retriever.search(question, filter={"tenant_id": tenant_id})

@traceable(name="support_answer", run_type="chain")
def answer(request):
    chunks = retrieve_policy(request.question, request.tenant_id)
    return compose(request.question, chunks)

TypeScript:

import { traceable } from "langsmith/traceable";

const retrievePolicy = traceable(
  async (question: string, tenantId: string) => retriever.search(question, tenantId),
  { name: "retrieve_policy", run_type: "retriever" },
);

serverless 运行时要确保 trace 在进程退出前提交;普通服务可使用后台发送降低请求延迟。具体配置按部署环境和当前 SDK 文档设置。

5、设计追踪字段字典

字段目的合适的值
request_id关联 API、队列、审计UUID
release定位代码变更commit/tag
prompt_version比较提示词稳定版本号
index_version定位 RAG 回归索引别名/版本
action_id关联审批与副作用UUID
source_ids分析检索document/chunk ID,不是完整原文

在 API 入口生成 request ID,并显式传遍 runtime;深层函数不要另起 ID。关键审计保存在业务数据库,不能只依赖 trace 平台。

6、脱敏和采样

根 run、子 Agent、工具异常和附件都要脱敏。高风险写操作与错误请求通常全量追踪;大量普通成功请求可采样。发布窗口临时提高采样,稳定后降低。记录采样策略,否则基于样本计算的失败率会误导。

Trace SDK 故障不应让主业务失败;但应产生内部 metric,避免长时间“静默失明”。

7、本篇验收

模拟 RAG 无命中、订单工具超时和输出 schema 失败。仅看 trace 就能指出失败节点、输入摘要、版本、耗时和错误码;trace 中找不到伪造 API key、邮箱和地址;关闭 tracing 后主请求仍能工作。

下一课用这些 trace 建立固定排障流程、反馈队列和监控指标。

官方阅读:Observability Quickstart

如果您觉得这篇文章有帮助,请点个赞吧~

分享文章

相关文章

更多文章 →
AI2026-09-01
Deep Agents 01:何为 Agent Harness,以及如何开始
1、本篇任务:完成一份多步骤、带证据的技术调研 普通客服 Agent 的问题短、工具少、输出即时。技术调研或编码任务会持续很久,产生计划、搜索结果、文件和中间结论。Deep Agents 在 LangChain/LangGraph 之上预装规划、虚拟文件系统、上下文压缩和子 Agent,适合这类开放任务。 本课让 Agent 比较两种向量数据库,并交付一份可验证报告。 2、什么时候需要 Deep Agent 满足以下两项以上再考虑:任务...
学习
AI2026-09-01
Deep Agents 02:子 Agent、虚拟文件系统与长期记忆
1、本篇任务:让主管只看结论,让子 Agent 处理细节 技术调研会产生几十次搜索和大量文件。如果全部进入主管上下文,真正的目标会被噪音淹没。本课用两个子 Agent: 收集证据, 检查结论;主管负责计划与最终合成。 2、什么时候委派,什么时候直接调用工具 适合委派:子任务有多步;需要专门提示或工具;会产生大量中间结果;只需返回有限结论。不适合:一步查询;主管需要全部中间上下文;协调成本超过任务本身。 3、配置专门子 Agent Pyt...
学习
AI2026-09-01
Deep Agents 03:生产化、Sandbox、权限与上线验收
1、本篇任务:让 Deep Agent 在隔离环境中分析代码 只读研究 Agent 风险有限;编码 Agent 需要读写文件、安装依赖和执行测试。本课不讲如何让模型写更漂亮的代码,只讲执行环境、权限、恢复和上线验收。 2、先做威胁模型 资产包括源代码、用户文件、云凭证、生产网络和发布权限;攻击入口包括用户消息、仓库内容、网页、依赖包、MCP 返回和命令输出。 Prompt injection 不是靠一句 system prompt 解决...
学习
AI2026-09-01
LangChain 01:全景、原理与学习路线
1、本篇学完要得到什么 这一篇只解决三个问题:LangChain 到底负责什么;它与 LangGraph、Deep Agents、LangSmith 是什么关系;后面应按什么顺序学习。 贯穿整套课程的项目是“退款政策与订单助手”。它最终能够:回答知识库中的退款规则;查询当前用户的订单;生成结构化答复;对真正的退款操作进行人工审批;断线后恢复;通过评测后发布。 先记住一句话: 模型负责理解与生成,应用负责数据、权限、状态和副作用。 如果把...
学习
AI2026-09-01
LangChain 02:模型、消息与结构化输出
1、本篇任务:让模型输出成为程序可以依赖的合同 上一课只证明 Agent 能运行。本课暂时不接业务工具,只完成一个“客服分诊器”:输入用户问题,输出意图、紧急程度、是否需要人工和给用户的答复。 本课的核心不是学更多模型参数,而是理解三层合同:消息决定模型看到了什么;schema 决定程序期待什么;业务校验决定结果是否真的可用。 2、消息不是一段字符串,而是一条执行记录 一次工具型对话通常包含四种消息: | 类型 | 由谁产生 | 作用...
学习
AI2026-09-01
LangChain 03:工具与 Agent——从函数到可控行动
1、本篇任务:让 Agent 安全地读取订单 上一课得到结构化分诊结果,但模型不知道真实订单。本课增加一个只读工具 ,走通完整 Agent 循环,并把模型、工具包装和领域服务的责任分开。 完成后,用户问“我的 A100 发货了吗”,Agent 会选择工具;工具只按当前登录用户查询;模型基于工具结果回答。它仍然不能退款,因为我们没有提供写工具。 2、工具的本质是受 schema 约束的应用函数 一个好工具需要:稳定名称、清楚描述、窄输入...
学习

评论

请登录后发表评论

去登录
加载评论中...

目录