LangSmith

面向智能体与 LLM 的可观测性平台,支持追踪、监控与在线质量评估

LangSmith 是 LangChain 出品的 Agent 与 LLM 可观测性及评估平台,提供完整链路追踪、生产监控和在线评估能力,可通过 Python、TypeScript、Go、Java SDK 接入任意 Agent 技术栈,定位延迟、成本与响应质量问题。新推出的 Tuned Evaluators 以专用后训练 judge 自动为生产 trace 附加质量反馈,首个能力 Perceived Error 可检测智能体出错、误解或走错方向的对话,帮助团队发现并修复线上故障

AI记忆LLM评测即时通讯集成可观测性追踪故障根因分析智能体测试生成第三方应用集成访问控制策略
访问官网
收录动态

5

最近更新

2026-09-25

评价样本

未收录

社区规模

—

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

LangSmith 是 LangChain 出品的 Agent 与 LLM 可观测性及评估平台,提供完整链路追踪、生产监控和在线评估能力,可通过 Python、TypeScript、Go、Java SDK 接入任意 Agent 技术栈,定位延迟、成本与响应质量问题。新推出的 Tuned Evaluators 以专用后训练 judge 自动为生产 trace 附加质量反馈,首个能力 Perceived Error 可检测智能体出错、误解或走错方向的对话,帮助团队发现并修复线上故障

核心功能

9 项已整理
AI记忆
LLM评测
即时通讯集成
可观测性追踪
故障根因分析
智能体
测试生成
第三方应用集成
访问控制策略

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 2 条收录动态
最近更新
2026-09-25
覆盖行业
程序员、企业it管理

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-09-25功能更新

    LangSmith 发布 Engine v2:新增红队测试(基于生产 trace 与仓库生成问题假设并验证)、更多问题检测类型(错误率/延迟/成本趋势、重复工具调用等低效轨迹),并可在人工审核前自动评测验证修复方案、一键开 PR;Managed Deep Agents 升级至 v0.8,新增用户级记忆(与智能体级记忆隔离、可分层设访问策略)、支持 agent/用户自有凭证连接 GitHub、Notion,Slack 渠道支持文件传输,并新增可对接任意 JSON webhook 的 HTTP 渠道。

  2. 2026-09-21功能更新

    LangSmith 评测上线 Jev-as-a-Judge:可将 TypeSafe AI 的 System One 模型 Jev 用作评估裁判,对智能体 trace(含生产运行、数据集与回归测试)返回 noul/choice/score 三类类型化结构化反馈;官方称在分类任务上比同类 LLM 便宜约 450 倍、快约 200 倍,并可对同一状态并行评估多个问题,可在任一 tracing 项目的 Evaluators 标签页启用。

  3. 2026-08-25功能更新

    LangSmith 新增基于角色的访问控制(RBAC)与新的 API 密钥体系,面向企业用户:管理员可在工作区/组织内为用户分配角色(内置 Admin/Viewer/Editor 三种系统角色)或创建带细粒度权限的自定义角色;新增 Personal Access Tokens 与 Service Keys 两类 API 密钥,旧 ls__ 密钥迁移为 service keys(2024-07-01 移除旧密钥)。

  4. 2026-08-25功能更新

    LangSmith 评测新增 Pytest 与 Vitest/Jest 集成(beta,随 v0.3.0 SDK 推出):开发者可直接在熟悉的 Pytest 或 Vitest/Jest 测试框架中运行 LangSmith 评测,复用现有测试工作流的灵活性与运行行为,同时保留 LangSmith 的可观测性、指标追踪与团队分享能力。

  5. 2026-08-18功能更新

    LangSmith 推出 Tuned Evaluators,自动为生产环境 trace 与线程附加质量反馈,首个能力 Perceived Error 可检测智能体出错或误解用户的对话,帮助团队发现并修复线上故障模式。

LangSmith 常见问题

关于 LangSmith 的定位、核心功能、价格与最近更新。

LangSmith 是什么?

LangSmith 是 LangChain 出品的 Agent 与 LLM 可观测性及评估平台,提供完整链路追踪、生产监控和在线评估能力,可通过 Python、TypeScript、Go、Java SDK 接入任意 Agent 技术栈,定位延迟、成本与响应质量问题。新推出的 Tuned Evaluators 以专用后训练 judge 自动为生产 trace 附加质量反馈,首个能力 Perceived Error 可检测智能体出错、误解或走错方向的对话,帮助团队发现并修复线上故障。

LangSmith 有哪些核心功能?

LangSmith 当前已核验的核心功能包括:AI记忆、LLM评测、即时通讯集成、可观测性追踪、故障根因分析、智能体、测试生成、第三方应用集成、访问控制策略。

LangSmith 如何收费?

AI Equal 当前没有收录 LangSmith 的可验证价格信息。

LangSmith 最近有什么更新?

2026-09-25:LangSmith 发布 Engine v2:新增红队测试(基于生产 trace 与仓库生成问题假设并验证)、更多问题检测类型(错误率/延迟/成本趋势、重复工具调用等低效轨迹),并可在人工审核前自动评测验证修复方案、一键开 PR;Managed Deep Agents 升级至 v0.8,新增用户级记忆(与智能体级记忆隔离、可分层设访问策略)、支持 agent/用户自有凭证连接 GitHub、Notion,Slack 渠道支持文件传输,并新增可对接任意 JSON webhook 的 HTTP 渠道。