LangSmith 04:部署与上线治理

2026-09-01
11894 分钟
...

1、本篇任务:发布一个可恢复、可回滚的 Agent 服务

LangSmith 的观测和评测可以独立使用;Deployment/Agent Server 用于运行和管理长期、有状态 Agent。是否采用 Cloud、Hybrid、Self-hosted 或 Standalone,取决于数据边界、规模和运维能力,而不是功能越多越好。

2、先判断是否需要 Agent Server

简单 CLI 或 webhook 可以直接调用应用 worker。需要 thread/run 管理、断线恢复、长任务队列、HITL、定时运行和集中部署时,Agent Server 才明显有价值。

它不替代业务认证、租户 ACL、领域数据库、工具授权或幂等。平台管理图运行,应用仍管理业务事实。

3、部署制品

repo/
  graph/          # 编排代码与导出的 compiled graph
  domain/         # 业务服务接口
  tests/          # unit/integration/evals
  deployment/     # 镜像健康检查资源迁移
environment/
  secrets         # 模型DBLangSmith key由密钥管理注入
  versions        # releasepromptindexstate schema

锁定依赖和基础镜像;密钥不进入仓库或镜像;启动时验证配置和依赖;liveness/readiness 分离;状态 schema 迁移先演练再发布。

4、Run 生命周期

queuedrunningwaiting_for_inputrunningsucceeded
failed / cancelled / expired

每次迁移记录 request、thread、run、actor 和版本。取消不是关闭浏览器连接:停止派发新节点,终止可中断工作,等待不可中断工具完成并记录结果。恢复必须从授权 thread/checkpoint 继续,不能从 START 重放副作用。

5、容量与隔离

API 限制请求大小和用户/租户速率;run worker 限制并发、deadline、递归和队列公平性;模型限制 token、工具次数和费用;工具限制超时、可重试错误和熔断;checkpoint/artifact 设置 TTL、加密和访问审计。

压测混合短问答、长任务、待审批、慢工具和取消请求。只测 QPS 看不到长任务占满 worker、某租户影响其他租户等问题。

6、发布与回滚

构建固定制品staging 数据迁移与 eval小流量/影子运行
观察质量延迟成本安全扩大流量

回滚清单同时包含代码、prompt、模型、索引和 state schema。旧 thread 可绑定 graph version,由兼容 worker完成;不要让旧 checkpoint 突然交给不兼容新图。

7、必须演练的故障

流式断开后恢复;审批过期拒绝;模型 provider 故障时降级;向量库故障时拒答;worker 在副作用后崩溃仍不重复执行;trace 服务不可用不影响请求;候选版本安全 evaluator 回归时停止扩量并回滚。

每项演练留下 trace、指标、恢复步骤、负责人和自动化案例。

8、课程阶段验收

现在你应具备一条完整开发闭环:LangChain 构建 Agent,LangGraph控制状态和恢复,Deep Agents处理长任务,LangSmith解释运行、评测变更并治理部署。

最后四篇把这些能力迁移到简易 OpenCode 和单渠道 OpenClaw。重点不是重新背框架,而是把同一原则用于代码与消息系统。

官方阅读:DeploymentSelf-hosted LangSmith

如果您觉得这篇文章有帮助,请点个赞吧~

分享文章

相关文章

更多文章 →
AI2026-09-01
Deep Agents 01:何为 Agent Harness,以及如何开始
1、本篇任务:完成一份多步骤、带证据的技术调研 普通客服 Agent 的问题短、工具少、输出即时。技术调研或编码任务会持续很久,产生计划、搜索结果、文件和中间结论。Deep Agents 在 LangChain/LangGraph 之上预装规划、虚拟文件系统、上下文压缩和子 Agent,适合这类开放任务。 本课让 Agent 比较两种向量数据库,并交付一份可验证报告。 2、什么时候需要 Deep Agent 满足以下两项以上再考虑:任务...
学习
AI2026-09-01
Deep Agents 02:子 Agent、虚拟文件系统与长期记忆
1、本篇任务:让主管只看结论,让子 Agent 处理细节 技术调研会产生几十次搜索和大量文件。如果全部进入主管上下文,真正的目标会被噪音淹没。本课用两个子 Agent: 收集证据, 检查结论;主管负责计划与最终合成。 2、什么时候委派,什么时候直接调用工具 适合委派:子任务有多步;需要专门提示或工具;会产生大量中间结果;只需返回有限结论。不适合:一步查询;主管需要全部中间上下文;协调成本超过任务本身。 3、配置专门子 Agent Pyt...
学习
AI2026-09-01
Deep Agents 03:生产化、Sandbox、权限与上线验收
1、本篇任务:让 Deep Agent 在隔离环境中分析代码 只读研究 Agent 风险有限;编码 Agent 需要读写文件、安装依赖和执行测试。本课不讲如何让模型写更漂亮的代码,只讲执行环境、权限、恢复和上线验收。 2、先做威胁模型 资产包括源代码、用户文件、云凭证、生产网络和发布权限;攻击入口包括用户消息、仓库内容、网页、依赖包、MCP 返回和命令输出。 Prompt injection 不是靠一句 system prompt 解决...
学习
AI2026-09-01
LangChain 01:全景、原理与学习路线
1、本篇学完要得到什么 这一篇只解决三个问题:LangChain 到底负责什么;它与 LangGraph、Deep Agents、LangSmith 是什么关系;后面应按什么顺序学习。 贯穿整套课程的项目是“退款政策与订单助手”。它最终能够:回答知识库中的退款规则;查询当前用户的订单;生成结构化答复;对真正的退款操作进行人工审批;断线后恢复;通过评测后发布。 先记住一句话: 模型负责理解与生成,应用负责数据、权限、状态和副作用。 如果把...
学习
AI2026-09-01
LangChain 02:模型、消息与结构化输出
1、本篇任务:让模型输出成为程序可以依赖的合同 上一课只证明 Agent 能运行。本课暂时不接业务工具,只完成一个“客服分诊器”:输入用户问题,输出意图、紧急程度、是否需要人工和给用户的答复。 本课的核心不是学更多模型参数,而是理解三层合同:消息决定模型看到了什么;schema 决定程序期待什么;业务校验决定结果是否真的可用。 2、消息不是一段字符串,而是一条执行记录 一次工具型对话通常包含四种消息: | 类型 | 由谁产生 | 作用...
学习
AI2026-09-01
LangChain 03:工具与 Agent——从函数到可控行动
1、本篇任务:让 Agent 安全地读取订单 上一课得到结构化分诊结果,但模型不知道真实订单。本课增加一个只读工具 ,走通完整 Agent 循环,并把模型、工具包装和领域服务的责任分开。 完成后,用户问“我的 A100 发货了吗”,Agent 会选择工具;工具只按当前登录用户查询;模型基于工具结果回答。它仍然不能退款,因为我们没有提供写工具。 2、工具的本质是受 schema 约束的应用函数 一个好工具需要:稳定名称、清楚描述、窄输入...
学习

评论

请登录后发表评论

去登录
加载评论中...

目录