LangSmith 是什么?
LangSmith 是 LangChain 官方推出的 LLM 应用开发平台,提供追踪、调试、评估和监控能力,与 LangChain/LangGraph 生态深度绑定。如果你用 LangChain 构建应用,LangSmith 就是配套的「开发+运维」控制台。
LangSmith 的核心价值:追踪每次调用和 Agent 执行链,定位问题;建立数据集和评估器,对提示词、模型和检索做回归测试;上线后监控延迟、成本和错误率。对使用 LangChain 生态的团队,集成成本最低。
需要客观看待的是:它偏向 LangChain 生态,非 LangChain 项目集成价值打折;自托管能力有限,主要用云服务(免费开发额度 + 按量付费)。
百器AI 将 LangSmith 归入「AI 开发」分类,适合 LangChain/LangGraph 用户和 AI 工程团队。
产品截图

主要功能
LangChain 原生集成:追踪和调试一体化
评估数据集:建立回归测试
提示词管理:版本和对比
生产监控:延迟、成本和错误率
实验对比:不同提示词/模型效果对照
多语言:Python/JS SDK
如何使用
在 smith.langchain.com 创建项目
安装 LangSmith SDK 并配置 API Key
在 LangChain 应用中开启追踪
在控制台查看调用链和错误
建立评估数据集
对提示词和模型变更跑回归测试
监控生产环境指标并设置告警
核心优势
LangChain 生态集成最深
评估体系完善
开发到监控全流程
免费开发额度
同类竞品对比
| 对比维度 | LangSmith | Langfuse | promptfoo |
|---|---|---|---|
| 核心能力 | LangChain 原生集成:追踪和调试一体化;评估数据集:建立回归测试 | 全链路追踪:LLM 调用、Agent 步骤、检索过程完整记录;成本监控:token 用量和费用按功能/用户统计 | 提示词测试:回归测试和防回退;模型对比:多模型效果对照 |
| 上手门槛 | 免费版可体验,进阶功能按订阅收费 | 免费版可体验,进阶功能按订阅收费 | 免费版可体验,进阶功能按订阅收费 |
| 适合场景 | AI 应用调试 | AI 应用调试 | 选择适合业务的大模型 |
| 独特优势 | LangChain 生态集成最深 | 开源可自托管,数据私有 | 能减少凭感觉选型 |
| 注意事项 | 偏 LangChain 生态 | 接入有学习成本 | 需要维护测试集和指标 |
应用场景
AI 应用调试
评估回归
提示词迭代
生产监控
标签
注意点
偏 LangChain 生态
自托管能力有限
生产用量按量计费
不适用边界
常见问题
有免费开发额度,生产按用量计费,以官网为准。
相似工具
Langfuse
免费/付费开源的 LLM 可观测性平台:追踪、评估和调试 AI 应用,覆盖提示词、Agent 和 RAG 全链路。
promptfoo
免费/付费开源 LLM 评测和 Prompt 回归测试工具,适合比较模型、提示词和安全策略。
Vercel AI SDK
免费面向 TypeScript 开发者的 AI 应用 SDK,支持多模型调用、流式输出和前端集成。
LangChain.js
免费JavaScript/TypeScript 生态的 LLM 应用框架,适合构建 Agent、RAG 和工具调用流程。
LlamaIndex
免费/付费面向数据增强型 LLM 应用的开发框架,擅长连接文档、数据库和检索系统。
Haystack
免费开源 LLM 应用和搜索管道框架,适合构建检索增强生成、问答和文档处理系统。