链路追踪 ​

链路追踪记录 Agent 的执行过程,帮助用户查看模型请求、工具调用、Skill 调用和子 Agent 任务,定位耗时较长或出现错误的步骤。

  • Trace:一次执行的链路记录。
  • Span:链路中的一个执行节点,例如一次模型请求或工具调用。
  • 主 Agent/子 Agent:分别指执行入口任务的 Agent,以及执行过程中派生的子任务 Agent。

查找执行记录 ​

前置条件 ​

已完成 Agent 接入,并在接入的 Agent 中实际执行一次任务。

操作步骤 ​

  1. 在左侧选择 运行观测 > 链路追踪。
  2. 按问题发生时间选择时间、执行状态、框架和 Agent。首次打开默认查看“用户”归属、仅主 Agent 的记录。
  3. 需要排查子任务时,将 范围 改为 仅子 Agent 或 主 + 子 Agent。仅选择子 Agent 类型不会自动改变范围。
  4. 在搜索框输入任务内容或输出中的关键词;也可以从字段列表中选择字段、操作符和值,添加精确条件。
  5. 如需更多条件,单击 过滤,按 Skill、子 Agent 类型、模型、耗时或 Tokens 筛选。列表耗时条件的单位为秒。
  6. 单击某一记录行或 详情,进入执行详情。

操作结果 ​

列表显示符合条件的执行记录,上方显示执行次数、平均耗时和工具错误率。默认按执行时间从新到旧排列。单击 Agent、执行状态、Tokens 或执行时间表头可切换排序方向。筛选、排序和页码记录在当前网址中。

执行时间按浏览器本地时区显示;悬停时间可查看相对时间。使用右上方列设置调整显示列,拖动表头分隔线调整列宽。列设置和宽度保存在当前浏览器中。Trace ID 较长时会省略显示,拖宽列或悬停可查看完整 ID。

找不到记录时,先检查 Agent 归属和范围,再单击 重置筛选。重置后范围恢复“仅主 Agent”,Agent 归属变为“全部”。

理解执行状态 ​

状态含义
执行中尚未收到明确结束信号,且未满足无更新超时条件。
成功/正常已收到完成信号,且未识别到 Agent 根进程退出失败。列表筛选使用“成功”,详情摘要可能显示“正常”。
失败AcTrail 上报了 Agent 根进程的完整退出记录,且退出码非零。应结合具体节点错误信息复核原因。
超时未收到明确结束信号,且服务端连续 10 分钟未收到采集更新。适用于所有 Agent 和采集框架。

成功表示平台根据采集信息将本次执行判定为完成,不代表答案一定正确或所有工具调用均成功。

超时不会自动终止 Agent,也不等同于已确认的执行失败。后续有新数据到达时可以恢复“执行中”,收到结束信号后再转为最终状态。已经有结束信号的记录不适用这条兜底规则。

列表在页面可见时每 5 秒刷新。执行中或超时的详情默认每 5 秒刷新,可选择 5、10、30 或 60 秒,也可暂停后单击立即刷新;明确结束后停止自动刷新。

阅读节点和输入输出 ​

前置条件 ​

已进入一条 Trace 的详情页。

操作步骤 ​

  1. 在顶部查看 Trace 标识、状态、耗时和 Token。
  2. 在左侧调用树选择 Agent、LLM、Tool、Skill 等节点;Langfuse 数据还可显示 Chain 业务步骤。
  3. 对照时间条查看节点开始时间、持续时间以及执行先后关系。
  4. 在右侧查看当前节点的信息。选择 Agent 后可查看时间线;单击其中工具事件的摘要或 查看,打开事件详情。
  5. 在 Input 或 Output 旁单击 查看全部,阅读完整内容。单击 Copy 复制完整内容;工具事件详情的 Input、Output 也分别提供复制按钮。
  6. 需要查看子 Agent 的独立链路时,单击对应的 Trace 或 查看子 Trace 按钮;在子链路顶部单击 父执行 返回。

操作结果 ​

右侧显示所选节点的输入、输出及相关指标。查看全部 弹窗默认展开 JSON 对象、数组和长字符串,较长内容可滚动查看。

较长链路会先加载结构和统计,再按所选节点加载正文。等待节点内容加载后再查看、复制。这种加载方式不会削减导出文件中的完整链路数据。

展开/收起 用于控制子 Agent 及下层可展开节点。收起后仍保留根 Agent 及其直接节点;没有更深层级时,单击收起可能看不到变化。悬停按钮说明可查看其含义。

平台展示采集器已上报的数据。某个节点缺少输入、输出或 Token 时,应先核实对应采集方式是否上报了该字段。

定位慢节点 ​

前置条件 ​

已进入一条 Trace 的详情页,相关事件具有耗时数据。

操作步骤 ​

  1. 单击详情工具栏中的 仅慢节点(>60s)。
  2. 根据需要同时设置类型、Token 或搜索条件。
  3. 在筛选结果中选择事件,查看输入输出,结合工具调用、模型轮次和上下文判断耗时原因。
  4. 如需查看 >5s 等其他条件,先关闭 仅慢节点(>60s),再修改耗时条件。

操作结果 ​

事件行按耗时严格大于 60 秒筛选。普通事件使用结束时间与开始时间的差值;已关联子 Agent 的 Task 事件使用该子 Agent 的总耗时。恰好 60 秒或没有耗时数据的事件不会命中。慢节点表示耗时长,不表示发生错误。

  • Agent 行本身保留作层级上下文,因此保留下来的 Agent 行不代表该 Agent 一定超过 60 秒。
  • 子 Agent 仍依赖其父任务节点的显示和展开状态,不能理解为所有 Agent 都一定显示。
  • 开关旁的数字统计慢 Agent 数,不是筛选后可见的慢事件数。
  • 开启后,耗时条件固定显示 >60s 并暂时不可修改;关闭后恢复之前的耗时条件。

为记录添加标签 ​

前置条件 ​

链路列表中已显示“用户标签”列,或已进入目标 Trace 的详情页。

操作步骤 ​

  1. 在列表 用户标签 列单击 添加标签 或加号,也可以在详情顶部添加标签。
  2. 在“业务”或“版本”分区选择已有标签;再次单击可以解除该记录与标签的绑定。
  3. 没有合适标签时,选择类别、颜色,输入名称并创建。

操作结果 ​

选中的标签或新创建的标签立即绑定到当前 Trace。用户标签适合标记业务场景或版本。系统标签来自采集数据,默认隐藏;需要时通过列设置显示。

链路列表不提供业务标签筛选。

导出与导入 Trace ​

前置条件 ​

导出时已进入 Trace 详情;导入时已获得平台导出的 Trace Bundle JSON 文件。单个文件不超过 50 MB,最多包含 500 个执行节点。

操作步骤 ​

  1. 在详情单击 导出 Trace,下载 JSON 文件。即使当前打开的是子 Agent,导出范围仍包括根 Trace 和其全部已保存子 Agent 节点。
  2. 需要导入时,在列表右上角单击 导入 Trace,选择平台导出的 JSON 文件。
  3. 导入成功后,查看原 Trace ID、新 Trace ID 和节点数,并打开导入结果。

操作结果 ​

导入的数据归当前用户所有。标识没有冲突时保留原值,有冲突时自动生成新标识并更新父子关系。

该文件用于迁移链路与交互数据,不包含用户标签、评测结果、智能诊断报告或基础设施关联;导入不会自动发起评测。

后续操作 ​

需要将典型记录用于回归验证时,在详情单击 加入评测集;也可以在列表勾选多条记录后单击 加入评测数据集,然后到评测中心创建实验。