LangSmith
面向智能体与 LLM 的可观测性平台,支持追踪、监控与在线质量评估
LangSmith 是 LangChain 出品的 Agent 与 LLM 可观测性及评估平台,提供完整链路追踪、生产监控和在线评估能力,可通过 Python、TypeScript、Go、Java SDK 接入任意 Agent 技术栈,定位延迟、成本与响应质量问题。新推出的 Tuned Evaluators 以专用后训练 judge 自动为生产 trace 附加质量反馈,首个能力 Perceived Error 可检测智能体出错、误解或走错方向的对话,帮助团队发现并修复线上故障
5
2026-09-25
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
LangSmith 是 LangChain 出品的 Agent 与 LLM 可观测性及评估平台,提供完整链路追踪、生产监控和在线评估能力,可通过 Python、TypeScript、Go、Java SDK 接入任意 Agent 技术栈,定位延迟、成本与响应质量问题。新推出的 Tuned Evaluators 以专用后训练 judge 自动为生产 trace 附加质量反馈,首个能力 Perceived Error 可检测智能体出错、误解或走错方向的对话,帮助团队发现并修复线上故障
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 2 条收录动态
- 最近更新
- 2026-09-25
- 覆盖行业
- 程序员、企业it管理
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-25功能更新
LangSmith 发布 Engine v2:新增红队测试(基于生产 trace 与仓库生成问题假设并验证)、更多问题检测类型(错误率/延迟/成本趋势、重复工具调用等低效轨迹),并可在人工审核前自动评测验证修复方案、一键开 PR;Managed Deep Agents 升级至 v0.8,新增用户级记忆(与智能体级记忆隔离、可分层设访问策略)、支持 agent/用户自有凭证连接 GitHub、Notion,Slack 渠道支持文件传输,并新增可对接任意 JSON webhook 的 HTTP 渠道。
- 2026-09-21功能更新
LangSmith 评测上线 Jev-as-a-Judge:可将 TypeSafe AI 的 System One 模型 Jev 用作评估裁判,对智能体 trace(含生产运行、数据集与回归测试)返回 noul/choice/score 三类类型化结构化反馈;官方称在分类任务上比同类 LLM 便宜约 450 倍、快约 200 倍,并可对同一状态并行评估多个问题,可在任一 tracing 项目的 Evaluators 标签页启用。
- 2026-08-25功能更新
LangSmith 新增基于角色的访问控制(RBAC)与新的 API 密钥体系,面向企业用户:管理员可在工作区/组织内为用户分配角色(内置 Admin/Viewer/Editor 三种系统角色)或创建带细粒度权限的自定义角色;新增 Personal Access Tokens 与 Service Keys 两类 API 密钥,旧 ls__ 密钥迁移为 service keys(2024-07-01 移除旧密钥)。
- 2026-08-25功能更新
LangSmith 评测新增 Pytest 与 Vitest/Jest 集成(beta,随 v0.3.0 SDK 推出):开发者可直接在熟悉的 Pytest 或 Vitest/Jest 测试框架中运行 LangSmith 评测,复用现有测试工作流的灵活性与运行行为,同时保留 LangSmith 的可观测性、指标追踪与团队分享能力。
- 2026-08-18功能更新
LangSmith 推出 Tuned Evaluators,自动为生产环境 trace 与线程附加质量反馈,首个能力 Perceived Error 可检测智能体出错或误解用户的对话,帮助团队发现并修复线上故障模式。
LangSmith 常见问题
关于 LangSmith 的定位、核心功能、价格与最近更新。
LangSmith 是什么?
LangSmith 是 LangChain 出品的 Agent 与 LLM 可观测性及评估平台,提供完整链路追踪、生产监控和在线评估能力,可通过 Python、TypeScript、Go、Java SDK 接入任意 Agent 技术栈,定位延迟、成本与响应质量问题。新推出的 Tuned Evaluators 以专用后训练 judge 自动为生产 trace 附加质量反馈,首个能力 Perceived Error 可检测智能体出错、误解或走错方向的对话,帮助团队发现并修复线上故障。
LangSmith 有哪些核心功能?
LangSmith 当前已核验的核心功能包括:AI记忆、LLM评测、即时通讯集成、可观测性追踪、故障根因分析、智能体、测试生成、第三方应用集成、访问控制策略。
LangSmith 如何收费?
AI Equal 当前没有收录 LangSmith 的可验证价格信息。
LangSmith 最近有什么更新?
2026-09-25:LangSmith 发布 Engine v2:新增红队测试(基于生产 trace 与仓库生成问题假设并验证)、更多问题检测类型(错误率/延迟/成本趋势、重复工具调用等低效轨迹),并可在人工审核前自动评测验证修复方案、一键开 PR;Managed Deep Agents 升级至 v0.8,新增用户级记忆(与智能体级记忆隔离、可分层设访问策略)、支持 agent/用户自有凭证连接 GitHub、Notion,Slack 渠道支持文件传输,并新增可对接任意 JSON webhook 的 HTTP 渠道。